Рубріки: Новини

Grok 4 перевершив PhD-рівень по всіх тестах, максимальний тариф коштує $300 щомісяця

Дмитро Сімагін

Компанія xAI випустила Grok 4 — флагманську LLM-модель у сімействі Grok. Перші тести демонструють результати, які можна порівняти з рівнем PhD (доктор наук). Ілон Маск вже заявив, що Grok 4 — «найрозумніший штучний інтелект в історії людства».

Результати тестів Grok 4:

  • Новий рекорд на Humanity’s Last Exam — 50,7% при використанні багатоагентної архітектури.
  • Без багатоагентного режиму результат все одно вражає — 25%, що вище, ніж у інших LLM-моделей.
  • На AIME 25 (математична олімпіада) — 100% правильних відповідей.
  • На ARC-AGI-2 (тест на загальний штучний інтелект) — 16% (попередні лідери показували 12-13%).

Багатоагентний режим передбачає, що замість одного модуля штучного інтелекту Grok запускає кілька агентів, які працюють над завданням паралельно, порівнюють гіпотези і приходять до спільного рішення. Це нагадує командну роботу людей — підхід, який активно досліджується у контексті AGI.

Grok 4 матиме спеціалізований інструмент для роботи з кодом, функціонал якого схожий на конкурентів: GitHub Copilot і GPT-4 Code Interpreter.

Модель Grok 4 доступна в двох варіантах: базова версія, яка входить у вартість звичайної передплати на X Premium, та максимальна Grok 4 Heavy за $300 на місяць.

Останні статті

Copilot тепер може створювати документи Office та підключатись до сторонніх сервісів

Компанія Microsoft випустила оновлення програми Copilot для Windows. Нова версія 1.25095.161.0 підтримує Copilot Connections та…

10.10.2025

Microsoft випускає Edit CLI — новий інструмент командного рядка для Windows 11

Microsoft додає новий інструмент до оновлення Windows 11 версії 25H2, яке випустили минулого тижня. Мова…

10.10.2025

OpenAI наздоганяє Anthropic в якості коду: Codex має 74,3% успішності порівняно з 73,7% у Claude Code

Агентний інструмент генерації коду Codex від компанії OpenAI наздоганяє за певними можливостями аналогічний продукт Claude…

10.10.2025

OpenAI збирається перетворити ChatGPT на операційну систему

Компанія OpenAI має намір перетворити ChatGPT на повноцінну операційну систему з екосистемою додатків. Про це…

09.10.2025

В Україні створили Кіберсили ЗСУ, до яких залучатимуть цивільних фахівців

Верховна Рада проголосувала за законопроект №12349 про створення Кіберсил Збройних Сил України. Документ, який підтримали…

09.10.2025

Багхантерам пропонують до $30 000 за знайдену помилку в інструментах штучного інтелекту

Google запустила програму винагород за знайдені вразливості в системах штучного інтелекту компанії. У разі успіху…

09.10.2025