Рубріки: Новини

Нова LLM-модель Deepseek v3.1 «краща за Claude Opus 4 і в 68 разів дешевша»

Дмитро Сімагін

Китайський стартап DeepSeek без зайвих анонсів випустив абсолютно нову LLM-модель V3.1. Вона має відкритий код, 685 мільярдів параметрів і довжину контексту до 128k, пише Venture Beat.

Модель досягла 71,6% балів у бенчмарку кодування Aider, зарекомендувавши себе як одна з найпродуктивніших моделей. DeepSeek V3.1 підтримує кілька форматів точності, від стандартного BF16 до експериментального FP8, що дозволяє розробникам оптимізувати продуктивність відповідно до їхніх апаратних обмежень. На цей час V3.1 посідає перше місце серед моделей з відкритим вихідним кодом.

«Deepseek v3.1 набирає 71,6% на aider – non-reasing SOTA. Це «на 1% краще, ніж Claude Opus 4, але в 68 разів дешевше», — написав дослідник штучного інтелекту Ендрю Крістіансон.

Справжній прорив полягає в тому, що DeepSeek називає своєю «гібридною архітектурою». На відміну від попередніх спроб поєднати різні можливості штучного інтелекту, що часто призводило до створення систем, які погано справлялися з усіма завданнями, V3.1 бездоганно інтегрує функції чату, міркування та кодування в єдину, узгоджену модель.

Нагадаємо, що провідний китайський стартап у сфері штучного інтелекту DeepSeek був змушений відкласти випуск своєї майбутньої моделі R2 через труднощі з її навчанням. Проблеми почались після втручання політиків у робочі процес.

Останні статті

CEO Replit: завдяки вайб-кодуванню керівникам більше не потрібно благати програмістів про допомогу

Глава стартапу Replit, який відомий однойменним IDE, Амджад Масад заявив, що інструменти вайб-кодингу змінюють баланс…

08.01.2026

OpenAI запустила бета-версію ChatGPT Health

Компанія OpenAI оголосила про запуск незалежного від основного інтерфейсу ChatGPT спеціального розділу ChatGPT Health. У…

08.01.2026

Фінансове планування для ІТ: як не загубитися серед валют, грантів і цифрових податків

ІТ‑галузь одна з найдинамічніших у світі. Технології змінюються буквально щотижня: нові фреймворки, хмарні сервіси, штучний…

08.01.2026

Помилку в ядрі Linux у середньому помічають через 2 роки

Опубліковано результати дослідження часу виявлення та усунення помилок у коді ядра Linux. Дані отримані в…

08.01.2026

Штучний інтелект не зможе замінити розробників щонайменше протягом 5 років

Люди, які займаються програмуванням, можуть отримати тимчасовий перепочинок від ризику втратити роботу. Згідно з новим…

08.01.2026

ChatGPT втрачає популярність. Користувачі все частіше дивляться в бік Google Gemini

Нові дані свідчать про те, що ChatGPT втрачає частку ринку чат-ботів на користь Gemini. Втрата…

08.01.2026