Рубріки: Новини

Devstral — нова LLM-модель з відкритим кодом, створена спеціально для розробки ПЗ

Дмитро Сімагін

Французький стартап Mistral випустив Devstral — нову LLM-модель з відкритим кодом, яка створена спеціально для розробки програмного забезпечення.

Devstral має 24 мільярдів параметрів, що робить її доступною для локального розгортання на ПК з одним графічним процесором Nvidia RTX 4090 або Mac із 32 ГБ оперативної пам’яті. Це може зацікавити тих розробників, яким важлива конфіденційність, або тих, хто працює без доступу до інтернету.

Модель підтримує контекстне вікно на 128 000 токенів та використовує токенізатор Tekken зі словником на 131 000 слів для роботи з великими кодовими базами. На відміну від більшості інших мовних моделей, які орієнтовані на автодоповнення коду, Devstral оптимізована для агентних робочих процесів. Вона інтегрується з фреймворками, такими як OpenHands, SWE-Agent та OpenDevin, що дозволяє їй аналізувати великі кодові бази, редагувати кілька файлів і виконувати багатоетапні завдання.

За даними Mistral, її модель перевершує інші аналогічні LLM з відкритим кодом, такі як Gemma 3 27B від Google і V3 від китайської DeepSeek. Згідно бенчмарку SWE-Bench Verified, Devstral набрала 46,8% на 500 реальних задачах з GitHub. Вона також випереджає на більш ніж 20% деякі закриті моделі, такі як GPT-4.1-mini. 

«На даний момент це, безумовно, найкраща відкрита модель для SWE-Bench Verified і для кодових агентів», — запевняють в Mistral.

Devstral доступна для завантаження на Hugging Face, Ollama, Kaggle, LM Studio та Unsloth. Модель підтримує фреймворки, включно з vLLM, Transformers та Mistral Inference. Також модель доступна через API Mistral Le Platforme під назвою `devstral-small-2505` з ціною $0,10 за мільйон вхідних токенів та $0,30 за мільйон вихідних токенів (приблизно 750 000 слів).

Нагадаємо, що днями стало відомо, що компанія Apple планує зробити свої LLM-моделі доступними для розробників.

 

Останні статті

Штучний інтелект поки не може замінити фрілансерів-кодерів, але цей день наближається

Дослідники з консалтингової компанії PeopleTec (Алабама, США) вирішили порівняти, як чотири LLM-моделі справляються з роботою…

22.05.2025

Помічник з кодування Google Jules став загальнодоступним

Google оголосила, що її новий помічник з кодування Jules тепер доступний в усьому світі в…

22.05.2025

JetBrains та Azul стверджують, що новий Zing JDK підвищує продуктивність Kotlin на 25%

Компанії JetBrains та Azul оголосили про «стратегічну технічну співпрацю» заради покращення продуктивності застосунків Kotlin, які…

22.05.2025

У PyPI виявили трояни, які сканували e-mail на наявність прив’язаних акаунтів TikTok та Instagram

У каталозі Python-пакетів PyPI виявили три шкідливих пакети, які діють як інструменти перевірки викрадених адрес…

22.05.2025

Google Meet навчили перекладати розмови в реальному часі. «Перекладачем» виступить Gemini

Компанія представила нову технологію, яка дозволить перекладати мову співрозмовників у сервісі Google Meet у онлайн-режимі.…

21.05.2025

1С має потрапити до реєстру забороненого ПЗ в Україні. Ним досі користується 75% компаній

Асоціація IT Ukraine допомагатиме Держспецзв’язку формувати критерії, за якими відбиратимуть програмне забезпечення, яке потрапить під…

21.05.2025