Рубріки: Новини

Нова LLM-модель Deepseek v3.1 «краща за Claude Opus 4 і в 68 разів дешевша»

Дмитро Сімагін

Китайський стартап DeepSeek без зайвих анонсів випустив абсолютно нову LLM-модель V3.1. Вона має відкритий код, 685 мільярдів параметрів і довжину контексту до 128k, пише Venture Beat.

Модель досягла 71,6% балів у бенчмарку кодування Aider, зарекомендувавши себе як одна з найпродуктивніших моделей. DeepSeek V3.1 підтримує кілька форматів точності, від стандартного BF16 до експериментального FP8, що дозволяє розробникам оптимізувати продуктивність відповідно до їхніх апаратних обмежень. На цей час V3.1 посідає перше місце серед моделей з відкритим вихідним кодом.

«Deepseek v3.1 набирає 71,6% на aider – non-reasing SOTA. Це «на 1% краще, ніж Claude Opus 4, але в 68 разів дешевше», — написав дослідник штучного інтелекту Ендрю Крістіансон.

Справжній прорив полягає в тому, що DeepSeek називає своєю «гібридною архітектурою». На відміну від попередніх спроб поєднати різні можливості штучного інтелекту, що часто призводило до створення систем, які погано справлялися з усіма завданнями, V3.1 бездоганно інтегрує функції чату, міркування та кодування в єдину, узгоджену модель.

Нагадаємо, що провідний китайський стартап у сфері штучного інтелекту DeepSeek був змушений відкласти випуск своєї майбутньої моделі R2 через труднощі з її навчанням. Проблеми почались після втручання політиків у робочі процес.

Останні статті

«Штраф до 500 тисяч рублів або позбавлення волі до 6 років»: росіян будуть карати за стріми з українською грою S.T.A.L.K.E.R 2

Російська Генпрокуратура визнала «небажаною» діяльність української геймдев-студії GSC Game World, яка відома розробкою серії постапокаліптичних…

19.11.2025

«Відмовився переходити на українську»: програмісти з Азії видають себе за українців, але діалог викриває брехню

Підшукуючи кандидатів на посаду розробника проекту з AI-автоматизації, Project Manager Анастасія Кирнична була сильно здивована,…

19.11.2025

У 2025 році жінки відкрили в Україні 8011 ФОП з КВЕДом «Комп’ютерне програмування»

З початку 2025 року українські жінки відкрили 8011 ФОП з КВЕДом «Комп’ютерне програмування», що становить…

19.11.2025

Google розробляє версію AI Studio для мобільного вайб-кодування

Незабаром Google випустить мобільну версію AI Studio. Популярна платформа для вайб-кодування на базі Gemini з'явиться…

19.11.2025

Gemini 3 Pro від Google стає новим лідером в кодуванні, випередивши Claude Sonnet 4.5

Компанія Google випустила нову мультимодальну LLM-модель Gemini 3 Pro, яку вже названо найпотужнішою з усіх…

19.11.2025

Лінус Торвальдс не проти вайб-кодингу, але не для професійної розробки

Творець Linux і Git Лінус Торвальдс заявив на саміті Linux Foundation Open Source Summit у…

18.11.2025