Рубріки: Новини

Google випустила модель міркування Gemini Deep 2.5 Think, яка одночасно тестує кілька ідей

Дмитро Сімагін

Команда Google DeepMind випустила Gemini 2.5 Deep Think — модель міркування, яка здатна відповідати на запитання, писати код, досліджувати та розглядати кілька ідей одночасно, а потім використовувати отримані результати для вибору найкращої відповіді. Про це пише TechCrunch.

Починаючи з сьогоднішнього дня передплатники Google Ultra отримають доступ до Gemini 2.5 Deep Think у додатку Gemini. Доступ через Gemini API буде надано обраній групі тестувальників найближчими тижнями.

Gemini 2.5 Deep Think, яку вперше продемонстрували в травні на конференції Google I/O 2025, є першою загальнодоступною мультиагентною моделлю Google. На відміну від інших LLM, вона використовує кілька агентів для паралельного розв’язання задачі. Цей процес вимагає значно більше обчислювальних ресурсів, ніж робота з одним агентом, але зазвичай дає більш якісні результати.

Компанія Google використала модифікацію Gemini 2.5 Deep Think, щоб вибороти золоту медаль на Міжнародній математичній олімпіаді (IMO) цього року.

Остання версія Gemini 2.5 Deep Think значно вдосконалена порівняно з тим, що було представлено на конференції I/O. Представники Google стверджують, що компанія розробила нові методи навчання з підкріпленням, які дозволяють Gemini 2.5 Deep Think краще використовувати свої логічні шляхи.

«Deep Think може допомогти людям вирішувати проблеми, що вимагають творчого підходу, стратегічного планування та поетапного вдосконалення», — пояснюється в блозі Google.

Gemini 2.5 Deep Think демонструє найвищу продуктивність на «Останньому іспиті людства» (Humanity’s Last Exam, HLE) — складному тесті, що оцінює здатність LLM-моделі відповідати на тисячі питань з математики, гуманітарних наук та природничих наук. Модель набрала 34,8% балів на HLE (без використання інструментів), у той час як Grok 4 від xAI набрав 25,4%, а G3 від OpenAI – 20,3%.

Google також заявляє, що Gemini 2.5 Deep Think перевершує моделі штучного інтелекту від OpenAI, xAI та Anthropic у LiveCodeBench6 – складному тесті на виконання завдань програмування. Модель Google набрала 87,6%, у той час як Grok 4 набрав 79%, а o3 від OpenAI – 72%.

Gemini 2.5 Deep Think автоматично працює з такими інструментами, як виконання коду та пошук у Google. 

Останні статті

Розробник пояснив, чому React вбиває інновації у фронтенді

React, який вважається одним з найпопулярніших JavaScript-фреймворків, вже не перемагає за рахунок своїх технічних переваг.…

16.09.2025

🚀 Ethereum Meetup у Львові!

Ethereum Ukraine вперше приїжджає до Львова – обговорити Ethereum, поспілкуватися й знайти однодумців для нових ідей.…

16.09.2025

VS Code отримав автоматичний вибір моделі. Він надає перевагу Claude 4

Microsoft додає автоматичний вибір LLM-моделі до свого редактора коду Visual Studio Code. Незважаючи на тісну…

16.09.2025

У жовтні Microsoft примусово встановить Copilot у ваші офісні програми

Наступного місяця Microsoft почне автоматично інсталювати віртуальний помічник Copilot у програми Microsoft 365 Office для…

16.09.2025

Вайб-кодинг відходить в минуле. На його зміну прийшов «рій агентів»

Нова технологія кодування, відома як agentic swarm coding (рій агентів), набуває все більшої популярності. За…

16.09.2025

OpenAI випустила GPT‑5-Codex — модель, оптимізовану для агентного кодування

OpenAI оголосила про випуск нової версії моделі GPT-5, яка оптимізована для агентного кодування на базі…

16.09.2025