Рубріки: Новини

Google випустила модель міркування Gemini Deep 2.5 Think, яка одночасно тестує кілька ідей

Дмитро Сімагін

Команда Google DeepMind випустила Gemini 2.5 Deep Think — модель міркування, яка здатна відповідати на запитання, писати код, досліджувати та розглядати кілька ідей одночасно, а потім використовувати отримані результати для вибору найкращої відповіді. Про це пише TechCrunch.

Починаючи з сьогоднішнього дня передплатники Google Ultra отримають доступ до Gemini 2.5 Deep Think у додатку Gemini. Доступ через Gemini API буде надано обраній групі тестувальників найближчими тижнями.

Gemini 2.5 Deep Think, яку вперше продемонстрували в травні на конференції Google I/O 2025, є першою загальнодоступною мультиагентною моделлю Google. На відміну від інших LLM, вона використовує кілька агентів для паралельного розв’язання задачі. Цей процес вимагає значно більше обчислювальних ресурсів, ніж робота з одним агентом, але зазвичай дає більш якісні результати.

Компанія Google використала модифікацію Gemini 2.5 Deep Think, щоб вибороти золоту медаль на Міжнародній математичній олімпіаді (IMO) цього року.

Остання версія Gemini 2.5 Deep Think значно вдосконалена порівняно з тим, що було представлено на конференції I/O. Представники Google стверджують, що компанія розробила нові методи навчання з підкріпленням, які дозволяють Gemini 2.5 Deep Think краще використовувати свої логічні шляхи.

«Deep Think може допомогти людям вирішувати проблеми, що вимагають творчого підходу, стратегічного планування та поетапного вдосконалення», — пояснюється в блозі Google.

Gemini 2.5 Deep Think демонструє найвищу продуктивність на «Останньому іспиті людства» (Humanity’s Last Exam, HLE) — складному тесті, що оцінює здатність LLM-моделі відповідати на тисячі питань з математики, гуманітарних наук та природничих наук. Модель набрала 34,8% балів на HLE (без використання інструментів), у той час як Grok 4 від xAI набрав 25,4%, а G3 від OpenAI – 20,3%.

Google також заявляє, що Gemini 2.5 Deep Think перевершує моделі штучного інтелекту від OpenAI, xAI та Anthropic у LiveCodeBench6 – складному тесті на виконання завдань програмування. Модель Google набрала 87,6%, у той час як Grok 4 набрав 79%, а o3 від OpenAI – 72%.

Gemini 2.5 Deep Think автоматично працює з такими інструментами, як виконання коду та пошук у Google. 

Останні статті

Diia.City United закликала Верховну Раду врахувати потреби бізнесу й внести зміни в Defence City

Diia.City United закликає ґрунтовно переробити законопроєкт «Defence City» та під час другого читання врахувати потреби…

01.08.2025

Айтівець з SQUAD загинув разом із донькою та собакою внаслідок атаки на Київ 31 липня

Спеціаліст з ІТ-підтримки із SQUAD Віталій Рабощук, його 18-річна донька Влада та пес Спайк загинули,…

01.08.2025

Нова функція Android Studio автоматично виконує складні багатоетапні завдання кодування для кількох файлів

Google представила стабільний реліз нової функції Narwhal для Android Studio. Вона має режим агента Gemini,…

01.08.2025

OpenAI відключила функцію, яка дозволяла Google індексувати діалоги з ChatGPT

Дослідники помітили, що пошукова система Google почала індексувати публічні посилання на діалоги з ChatGPT, внаслідок…

01.08.2025

Багхантери залишаться в минулому: на зміну ручному пошуку багів приходять агенти

У кібербезпеці помічена нова тенденція: тепер уразливості в коді все частіше шукають не люди, а…

01.08.2025

Microsoft спрощує розробку iOS-додатків за допомогою оновлень GitHub Copilot у Xcode

Microsoft оголосила про деякі оновлення інструменту GitHub Copilot у Xcode. Головним з них є підтримка…

01.08.2025