Рубріки: Новини

Розробники Hugging Face почали роботу над Open-R1 — «повністю відкритим» форком DeepSeek-R1

Дмитро Сімагін

29.01.2025 10:02

Керівник відділу Hugging Face Леандро фон Верра та кілька розробників компанії запустили Open-R1 — проект, який має на меті створити удосконалений форк моделі DeepSeek-R1 з відкритими даними для всіх компонентів, включно з тими, які використовуються для навчання. Як повідомляє TechCrunch, дослідження, для роботи над яким виділено 768 графічних процесорів Nvidia H100, лише за три дні набрало на GitHub понад 11 000 зірок.

Технічно DeepSeek-R1 має «відкритий» код, оскільки модель має дозвільну ліцензію, що дає можливість розгортати її без обмежень. Однак R1 не є «відкритим вихідним кодом» за загальноприйнятим визначенням, оскільки деякі інструменти, використані для її створення, оповиті таємницею. Як і багато інших компаній, які працюють над створенням систем штучного інтелекту, DeepSeek не хоче розкривати всі свої секрети.

«Модель R1 вражає, але немає відкритого набору даних, деталей експерименту чи проміжних моделей, що ускладнює реплікацію та подальші дослідження», — заявив Елі Бакуш, один з розробників проекту Open-R1.

Будучи моделлю міркування, R1 ефективно перевіряє факти, але її робота для пошуку рішення займає трохи більше часу — зазвичай секунди або хвилини — порівняно з іншими моделями без міркування. Перевагою є те, що відповіді R1, як правило, більш надійні в питаннях фізики, природничих наук та математики.

Якщо проект Open-R1 стане успішним, дослідники штучного інтелекту зможуть доповнити навчальний конвеєр і працювати над розробкою моделей міркування з відкритим кодом наступного покоління.

«Коли форк R1 буде відтворено, будь-хто, хто може орендувати кілька графічних процесорів, зможе створити свій варіант R1 із власними даними, ще більше поширюючи цю технологію», — додав Бакуш.

Наступна стаття Третина українських IT-спеціалістів працює в компаніях, що входять до «Дія.City» »

попередня стаття « «Я просто шукаю собі хлопця». HR Deloitte розповів про делікатне прохання від дівчини щодо співбесіди

Дмитро Сімагін

Теги: DeepSeekLLM-модельOpen-R1штучний інтелект

29.01.2025 10:02

Останні статті

Новини

«Потенційно небезпечні»: експерти радять заборонити браузери зі штучним інтелектом

За даними аналітичної компанії Gartner, браузери зі штучним інтелектом, такі як Comet від Perplexity та…

08.12.2025

Новини

Найпотужніша модель кодування OpenAI стає більш доступною

Компанія OpenAI розширює доступ до своєї найпотужнішою моделі кодування GPT-5.1-Codex-Max. Ця LLM, орієнтована на розробників,…

05.12.2025

Новини

Google відкрила для платних користувачів доступ до Gemini 3 Deep Think — нового лідера серед LLM

Компанія Google оголосила про запуск моделі штучного інтелекту Gemini 3 Deep Think. Вона використовує ще…

05.12.2025

Новини

Витративши $70 мільярдів на розробку Метавсесвіту, Цукерберг скорочує проект

Meta планує різке скорочення свого підрозділу Reality Labs, який займається розробкою так званого Метавсесвіту (Metaverse).…

05.12.2025

Новини

Розробників закликають терміново оновити React та Next.js

Розробникам, які використовують бібліотеку React 19 для створення інтерфейсів додатків, рекомендується негайно оновити її до…

05.12.2025

Новини

Творець Linux вважає Ілона Маска «занадто дурним» для роботи в IT

Творець Linux, знаменитий фінський розробник Лінус Торвальдс, різко висловився щодо практики оцінки ефективності програмістів, яку…

05.12.2025

Розробники Hugging Face почали роботу над Open-R1 — «повністю відкритим» форком DeepSeek-R1

Схожі статті

Останні статті

«Потенційно небезпечні»: експерти радять заборонити браузери зі штучним інтелектом

Найпотужніша модель кодування OpenAI стає більш доступною

Google відкрила для платних користувачів доступ до Gemini 3 Deep Think — нового лідера серед LLM

Витративши $70 мільярдів на розробку Метавсесвіту, Цукерберг скорочує проект

Розробників закликають терміново оновити React та Next.js

Творець Linux вважає Ілона Маска «занадто дурним» для роботи в IT