Рубріки: Новини

Google випустила модель міркування Gemini Deep 2.5 Think, яка одночасно тестує кілька ідей

Дмитро Сімагін

Команда Google DeepMind випустила Gemini 2.5 Deep Think — модель міркування, яка здатна відповідати на запитання, писати код, досліджувати та розглядати кілька ідей одночасно, а потім використовувати отримані результати для вибору найкращої відповіді. Про це пише TechCrunch.

Починаючи з сьогоднішнього дня передплатники Google Ultra отримають доступ до Gemini 2.5 Deep Think у додатку Gemini. Доступ через Gemini API буде надано обраній групі тестувальників найближчими тижнями.

Gemini 2.5 Deep Think, яку вперше продемонстрували в травні на конференції Google I/O 2025, є першою загальнодоступною мультиагентною моделлю Google. На відміну від інших LLM, вона використовує кілька агентів для паралельного розв’язання задачі. Цей процес вимагає значно більше обчислювальних ресурсів, ніж робота з одним агентом, але зазвичай дає більш якісні результати.

Компанія Google використала модифікацію Gemini 2.5 Deep Think, щоб вибороти золоту медаль на Міжнародній математичній олімпіаді (IMO) цього року.

Остання версія Gemini 2.5 Deep Think значно вдосконалена порівняно з тим, що було представлено на конференції I/O. Представники Google стверджують, що компанія розробила нові методи навчання з підкріпленням, які дозволяють Gemini 2.5 Deep Think краще використовувати свої логічні шляхи.

«Deep Think може допомогти людям вирішувати проблеми, що вимагають творчого підходу, стратегічного планування та поетапного вдосконалення», — пояснюється в блозі Google.

Gemini 2.5 Deep Think демонструє найвищу продуктивність на «Останньому іспиті людства» (Humanity’s Last Exam, HLE) — складному тесті, що оцінює здатність LLM-моделі відповідати на тисячі питань з математики, гуманітарних наук та природничих наук. Модель набрала 34,8% балів на HLE (без використання інструментів), у той час як Grok 4 від xAI набрав 25,4%, а G3 від OpenAI – 20,3%.

Google також заявляє, що Gemini 2.5 Deep Think перевершує моделі штучного інтелекту від OpenAI, xAI та Anthropic у LiveCodeBench6 – складному тесті на виконання завдань програмування. Модель Google набрала 87,6%, у той час як Grok 4 набрав 79%, а o3 від OpenAI – 72%.

Gemini 2.5 Deep Think автоматично працює з такими інструментами, як виконання коду та пошук у Google. 

Останні статті

Екс-менеджер Meta: Лише 2% розробників використовують штучний інтелект правильно. Решта ризикують своєю роботою

Кун Чен — колишній розробник Microsoft та Atlassian, а також інженерний менеджер Meta — впевнений:…

01.05.2026

Пентагон розробляє лазерну зброю потужністю 300 кВт для знищення крилатих ракет

Міністерство оборони США офіційно підтверджує роботу над принципово новою системою лазерної зброї в рамках масштабної…

01.05.2026

GPT-5.5 зрівнявся з Claude Mythos у тестах на кібератаки — висновки британського AISI

Британський Інститут безпеки штучного інтелекту (AISI) перевірив модель штучного інтелекту GPT-5.5 від OpenAI і встановив,…

01.05.2026

«Термінатора» в зал суду не пустили: Ілон Маск перетворив позов проти OpenAI на sci-fi шоу

Ілон Маск три дні свідчив в рамках судового позову проти Сема Альтмана та OpenAI —…

01.05.2026

Програмна археологія: Microsoft публікує код найстарішої версії DOS, яку вважали втраченою

Microsoft продовжує розкривати сторінки своєї цифрової спадщини. Днями компанія опублікувала найстаріший із виявлених на сьогодні…

01.05.2026

Моделі Anthropic з’являться в Microsoft Word для роботи з документами

Компанія Microsoft оголосила про додавання моделей штучного інтелекту від Anthropic до Microsoft 365 Copilot у…

01.05.2026