Рубріки: Новини

Розробники Hugging Face почали роботу над Open-R1 — «повністю відкритим» форком DeepSeek-R1

Дмитро Сімагін

Керівник відділу Hugging Face Леандро фон Верра та кілька розробників компанії запустили Open-R1 — проект, який має на меті створити удосконалений форк моделі DeepSeek-R1 з відкритими даними для всіх компонентів, включно з тими, які використовуються для навчання. Як повідомляє TechCrunch, дослідження, для роботи над яким виділено 768 графічних процесорів Nvidia H100, лише за три дні набрало на GitHub понад 11 000 зірок. 

Технічно DeepSeek-R1 має «відкритий» код, оскільки модель має дозвільну ліцензію, що дає можливість розгортати її без обмежень. Однак R1 не є «відкритим вихідним кодом» за загальноприйнятим визначенням, оскільки деякі інструменти, використані для її створення, оповиті таємницею. Як і багато інших компаній, які працюють над створенням систем штучного інтелекту, DeepSeek не хоче розкривати всі свої секрети.

«Модель R1 вражає, але немає відкритого набору даних, деталей експерименту чи проміжних моделей, що ускладнює реплікацію та подальші дослідження», — заявив Елі Бакуш, один з розробників проекту Open-R1. 

Будучи моделлю міркування, R1 ефективно перевіряє факти, але її робота для пошуку рішення займає трохи більше часу — зазвичай секунди або хвилини — порівняно з іншими моделями без міркування. Перевагою є те, що відповіді R1, як правило, більш надійні в питаннях фізики, природничих наук та математики.

Якщо проект Open-R1 стане успішним, дослідники штучного інтелекту зможуть доповнити навчальний конвеєр і працювати над розробкою моделей міркування з відкритим кодом наступного покоління.

«Коли форк R1 буде відтворено, будь-хто, хто може орендувати кілька графічних процесорів, зможе створити свій варіант R1 із власними даними, ще більше поширюючи цю технологію», — додав Бакуш. 

Останні статті

Міноборони розширило функціонал мобільного додатку Резерв+

Міністерство оборони України розширило можливість сплати штрафів через мобільний додаток Резерв+. Тепер у ньому можна…

05.09.2025

Побутова техніка Tesla: армовані метали, передові полімери та доступна ціна. Що представлено в лінійках

Втома від техніки, яка швидко зношується, змушує українців переглядати підхід до покупок. Відтепер на перше…

05.09.2025

Код, згенерований інструментами ШІ, створює вдесятеро більше проблем безпеки

Спеціалісти компанії Apiiro, які проаналізували код з десятків тисяч репозиторіїв, виявили, що розробники за допомогою…

05.09.2025

Державна платформа Brave1 оголошує гранти до 100 млн грн для ШІ-розробників

Маркетплейс Brave1 — онлайн-платформа, що об'єднує українських військових та розробників — запускає грантовий конкурс з…

05.09.2025

У Києві пройде перший хакатон з вайб-кодингу: як взяти участь

4-5 жовтня в Києві на Подолі пройде захід Vibecoding Hackathon. Протягом двох днів розробники, користувачі…

05.09.2025

OpenAI запустить платформу для IT-найму та програму сертифікації навичок

OpenAI готується запустити платформу для найму, яка конкуруватиме з LinkedIn. Майбутній сервіс під назвою OpenAI…

05.09.2025