Рубріки: Новини

Нова LLM-модель Deepseek v3.1 «краща за Claude Opus 4 і в 68 разів дешевша»

Дмитро Сімагін

Китайський стартап DeepSeek без зайвих анонсів випустив абсолютно нову LLM-модель V3.1. Вона має відкритий код, 685 мільярдів параметрів і довжину контексту до 128k, пише Venture Beat.

Модель досягла 71,6% балів у бенчмарку кодування Aider, зарекомендувавши себе як одна з найпродуктивніших моделей. DeepSeek V3.1 підтримує кілька форматів точності, від стандартного BF16 до експериментального FP8, що дозволяє розробникам оптимізувати продуктивність відповідно до їхніх апаратних обмежень. На цей час V3.1 посідає перше місце серед моделей з відкритим вихідним кодом.

«Deepseek v3.1 набирає 71,6% на aider – non-reasing SOTA. Це «на 1% краще, ніж Claude Opus 4, але в 68 разів дешевше», — написав дослідник штучного інтелекту Ендрю Крістіансон.

Справжній прорив полягає в тому, що DeepSeek називає своєю «гібридною архітектурою». На відміну від попередніх спроб поєднати різні можливості штучного інтелекту, що часто призводило до створення систем, які погано справлялися з усіма завданнями, V3.1 бездоганно інтегрує функції чату, міркування та кодування в єдину, узгоджену модель.

Нагадаємо, що провідний китайський стартап у сфері штучного інтелекту DeepSeek був змушений відкласти випуск своєї майбутньої моделі R2 через труднощі з її навчанням. Проблеми почались після втручання політиків у робочі процес.

Останні статті

Gmail додає наскрізне шифрування на відправку електронних листів будь-кому

Google оголошує, що користувачі Gmail тепер можуть надсилати електронні листи з наскрізним шифруванням будь-кому, навіть…

03.10.2025

Кількість IT-вакансій в Україні за квартал зросла на 12%. Це рекордний показник з початку війни

У третьому кварталі (липень, серпень, вересень) на сервісі пошуку роботи jobs.dou.ua опублікувано 20899 IT-вакансій. Це…

03.10.2025

Google вимагає по $25 з кожного Android-розробника «за верифікацію». Але будуть виключення

Представники Google розкрили додаткові подробиці майбутньої верифікації Android-розробників, яка почнеться в 2026 році. За реєстрацію…

03.10.2025

Python-розробники отримали можливість імпортувати в Excel бібліотеки на свій вибір

Microsoft анонсувала нову потужну функцію для Python-розробників у Microsoft Excel для Windows: редагування ініціалізації. Вона…

03.10.2025

В інструмент кодування Jules додали інтерфейс командного рядка та публічний API

Google додає в Jules інтерфейс командного рядка та публічний API, що дозволяє цьому інструменту кодування…

03.10.2025

Хакери зламали приватні репозиторії Red Hat на GitHub

Хакерське угруповання Crimson Collective зламало приватні GitHub-репозиторії компанії Red Hat, яка займається розробкою корпоративного програмного…

02.10.2025