Рубріки: Новини

Розробники Hugging Face почали роботу над Open-R1 — «повністю відкритим» форком DeepSeek-R1

Дмитро Сімагін

Керівник відділу Hugging Face Леандро фон Верра та кілька розробників компанії запустили Open-R1 — проект, який має на меті створити удосконалений форк моделі DeepSeek-R1 з відкритими даними для всіх компонентів, включно з тими, які використовуються для навчання. Як повідомляє TechCrunch, дослідження, для роботи над яким виділено 768 графічних процесорів Nvidia H100, лише за три дні набрало на GitHub понад 11 000 зірок. 

Технічно DeepSeek-R1 має «відкритий» код, оскільки модель має дозвільну ліцензію, що дає можливість розгортати її без обмежень. Однак R1 не є «відкритим вихідним кодом» за загальноприйнятим визначенням, оскільки деякі інструменти, використані для її створення, оповиті таємницею. Як і багато інших компаній, які працюють над створенням систем штучного інтелекту, DeepSeek не хоче розкривати всі свої секрети.

«Модель R1 вражає, але немає відкритого набору даних, деталей експерименту чи проміжних моделей, що ускладнює реплікацію та подальші дослідження», — заявив Елі Бакуш, один з розробників проекту Open-R1. 

Будучи моделлю міркування, R1 ефективно перевіряє факти, але її робота для пошуку рішення займає трохи більше часу — зазвичай секунди або хвилини — порівняно з іншими моделями без міркування. Перевагою є те, що відповіді R1, як правило, більш надійні в питаннях фізики, природничих наук та математики.

Якщо проект Open-R1 стане успішним, дослідники штучного інтелекту зможуть доповнити навчальний конвеєр і працювати над розробкою моделей міркування з відкритим кодом наступного покоління.

«Коли форк R1 буде відтворено, будь-хто, хто може орендувати кілька графічних процесорів, зможе створити свій варіант R1 із власними даними, ще більше поширюючи цю технологію», — додав Бакуш. 

Останні статті

«Потенційно небезпечні»: експерти радять заборонити браузери зі штучним інтелектом

За даними аналітичної компанії Gartner, браузери зі штучним інтелектом, такі як Comet від Perplexity та…

08.12.2025

Найпотужніша модель кодування OpenAI стає більш доступною

Компанія OpenAI розширює доступ до своєї найпотужнішою моделі кодування GPT-5.1-Codex-Max. Ця LLM, орієнтована на розробників,…

05.12.2025

Google відкрила для платних користувачів доступ до Gemini 3 Deep Think — нового лідера серед LLM

Компанія Google оголосила про запуск моделі штучного інтелекту Gemini 3 Deep Think. Вона використовує ще…

05.12.2025

Витративши $70 мільярдів на розробку Метавсесвіту, Цукерберг скорочує проект

Meta планує різке скорочення свого підрозділу Reality Labs, який займається розробкою так званого Метавсесвіту (Metaverse).…

05.12.2025

Розробників закликають терміново оновити React та Next.js

Розробникам, які використовують бібліотеку React 19 для створення інтерфейсів додатків, рекомендується негайно оновити її до…

05.12.2025

Творець Linux вважає Ілона Маска «занадто дурним» для роботи в IT

Творець Linux, знаменитий фінський розробник Лінус Торвальдс, різко висловився щодо практики оцінки ефективності програмістів, яку…

05.12.2025