Рубріки: Новини

Google випустила модель міркування Gemini Deep 2.5 Think, яка одночасно тестує кілька ідей

Дмитро Сімагін

Команда Google DeepMind випустила Gemini 2.5 Deep Think — модель міркування, яка здатна відповідати на запитання, писати код, досліджувати та розглядати кілька ідей одночасно, а потім використовувати отримані результати для вибору найкращої відповіді. Про це пише TechCrunch.

Починаючи з сьогоднішнього дня передплатники Google Ultra отримають доступ до Gemini 2.5 Deep Think у додатку Gemini. Доступ через Gemini API буде надано обраній групі тестувальників найближчими тижнями.

Gemini 2.5 Deep Think, яку вперше продемонстрували в травні на конференції Google I/O 2025, є першою загальнодоступною мультиагентною моделлю Google. На відміну від інших LLM, вона використовує кілька агентів для паралельного розв’язання задачі. Цей процес вимагає значно більше обчислювальних ресурсів, ніж робота з одним агентом, але зазвичай дає більш якісні результати.

Компанія Google використала модифікацію Gemini 2.5 Deep Think, щоб вибороти золоту медаль на Міжнародній математичній олімпіаді (IMO) цього року.

Остання версія Gemini 2.5 Deep Think значно вдосконалена порівняно з тим, що було представлено на конференції I/O. Представники Google стверджують, що компанія розробила нові методи навчання з підкріпленням, які дозволяють Gemini 2.5 Deep Think краще використовувати свої логічні шляхи.

«Deep Think може допомогти людям вирішувати проблеми, що вимагають творчого підходу, стратегічного планування та поетапного вдосконалення», — пояснюється в блозі Google.

Gemini 2.5 Deep Think демонструє найвищу продуктивність на «Останньому іспиті людства» (Humanity’s Last Exam, HLE) — складному тесті, що оцінює здатність LLM-моделі відповідати на тисячі питань з математики, гуманітарних наук та природничих наук. Модель набрала 34,8% балів на HLE (без використання інструментів), у той час як Grok 4 від xAI набрав 25,4%, а G3 від OpenAI – 20,3%.

Google також заявляє, що Gemini 2.5 Deep Think перевершує моделі штучного інтелекту від OpenAI, xAI та Anthropic у LiveCodeBench6 – складному тесті на виконання завдань програмування. Модель Google набрала 87,6%, у той час як Grok 4 набрав 79%, а o3 від OpenAI – 72%.

Gemini 2.5 Deep Think автоматично працює з такими інструментами, як виконання коду та пошук у Google. 

Останні статті

На хакерських форумах рекламують нове шкідливе ПЗ, яке можна непомітно вбудувати в будь-яку програму з Google Play

Фахівці компанії iVerify, яка спеціалізується на безпеці мобільних додатків, помітили, що на підпільних хакерських форумах…

17.12.2025

CEO AWS назвав три причини, чому не варто відмовлятись від найму джуніорів

Генеральний директор AWS Метт Гарман назвав три причини, чому компанії не повинні відмовлятись від найму…

17.12.2025

Українська мова лідирує за темпами розповсюдження в LLM-моделях

За останній рік кількість LLM-моделей з відкритим кодом, які працюють з українською мовою, зросла на…

17.12.2025

OpenAI обмежила безкоштовну генерацію коду в режимі Thinking

OpenAI відмовилася від автоперемикача вибору моделей, прибравши з нього режим Thinking для безкоштовних користувачів та…

17.12.2025

Користування GitHub Actions стане платним з 1 березня 2026 року

Платформа спільної розробки та хостингу коду GitHub оголосила про запровадження плати за користування GitHub Actions…

17.12.2025

Ціни на оперативну пам’ять за останній квартал зросли на 252%. Експерти пояснюють причини

Наприкінці осені ціни на оперативну пам'ять практично вибухнули, про що свідчить оновлений огляд ComputerBase на…

16.12.2025