Рубріки: Новини

Нова LLM-модель Deepseek v3.1 «краща за Claude Opus 4 і в 68 разів дешевша»

Дмитро Сімагін

Китайський стартап DeepSeek без зайвих анонсів випустив абсолютно нову LLM-модель V3.1. Вона має відкритий код, 685 мільярдів параметрів і довжину контексту до 128k, пише Venture Beat.

Модель досягла 71,6% балів у бенчмарку кодування Aider, зарекомендувавши себе як одна з найпродуктивніших моделей. DeepSeek V3.1 підтримує кілька форматів точності, від стандартного BF16 до експериментального FP8, що дозволяє розробникам оптимізувати продуктивність відповідно до їхніх апаратних обмежень. На цей час V3.1 посідає перше місце серед моделей з відкритим вихідним кодом.

«Deepseek v3.1 набирає 71,6% на aider – non-reasing SOTA. Це «на 1% краще, ніж Claude Opus 4, але в 68 разів дешевше», — написав дослідник штучного інтелекту Ендрю Крістіансон.

Справжній прорив полягає в тому, що DeepSeek називає своєю «гібридною архітектурою». На відміну від попередніх спроб поєднати різні можливості штучного інтелекту, що часто призводило до створення систем, які погано справлялися з усіма завданнями, V3.1 бездоганно інтегрує функції чату, міркування та кодування в єдину, узгоджену модель.

Нагадаємо, що провідний китайський стартап у сфері штучного інтелекту DeepSeek був змушений відкласти випуск своєї майбутньої моделі R2 через труднощі з її навчанням. Проблеми почались після втручання політиків у робочі процес.

Останні статті

«Без них всім буде погано»: керівники Microsoft виступили на захист джуніорів

Технічний директор Microsoft Azure Марк Руссінович та віце-президент Microsoft CoreAI Скотт Хансельман опублікували статтю під…

24.02.2026

Google та Apple тестують шифрування RCS-повідомлень між Android та iOS

Google та Apple почали тестування функції зашифрованого обміну повідомленнями по протоколу RCS між Android та…

24.02.2026

У Росії власника сайту заарештували на 15 діб за логотип Instagram

Міщанський районний суд Москви призначив 15 діб адміністративного арешту громадянину, якого звинуватили в незаконному розміщенні…

24.02.2026

Anthropic звинувачує китайські компанії в масовій крадіжці можливостей Claude

Компанія Anthropic звинуватила трьох провідних китайських розробників штучного інтелекту — DeepSeek, Moonshot та MiniMax. Їм…

24.02.2026

21-річний хакер викрав 127 млн грн у компаній батька голови Львівської ОВА: відразу купив собі Cadillac та BMW

Управління Нацполіції у Львівській області заочно повідомило підозру громадянину Денису Ніколаєву в причетності до крадіжки…

24.02.2026

Claude Code навчили оновлювати застарілі мови програмування: акції IBM обвалились на 13%

IT-гігант IBM став новою «жертвою» штучного інтелекту: компанія опинилась в епіцентрі ринкової паніки після новини…

24.02.2026