Google выпустила ИИ-модель Gemini 2.5 Deep Think

Подразделение Google DeepMind объявило о запуске Gemini 2.5 Deep Think, самой продвинутой на данный момент модели искусственного интеллекта компании, по словам разработчиков. Модель способна обрабатывать пользовательские запросы, исследуя и рассматривая несколько вариантов одновременно, а затем сравнивая и выбирая наилучший результат.

Пользователи с подпиской Google Ultra стоимостью 250 долларов в месяц получат доступ к новой ИИ-модели уже на этой неделе. Gemini 2.5 Deep Think была анонсирована на ежегодной конференции Google I/O в мае текущего года. В заявлении компании упоминалось, что это первая общедоступная модель, в которой объединены несколько ИИ-агентов. Такой подход позволяет нейросети задействовать различные ИИ-агенты для параллельной обработки запросов и поиска разнообразных ответов, что требует значительно больше вычислительных ресурсов, но обычно обеспечивает более качественные результаты по сравнению с системами, использующими один ИИ-агент.

В прошлом месяце стало известно, что алгоритм Gemini 2.5 Deep Think достиг результатов на уровне золотой медали на Международной математической олимпиаде (IMO). На пары с ней Google также представит версию ИИ-модели, принимавшую участие в олимпиаде, но только для ограниченной группы избранных математиков и ученых. Компания надеется, что этот алгоритм повысит эффективность исследований, и планирует собирать отзывы для дальнейшего усовершенствования мультиагентной системы в академической сфере. Google сообщила, что Gemini 2.5 Deep Think была значительно усовершенствована по сравнению с версией, представленным на конференции I/O. Эти улучшения стали возможны благодаря разработке «новых методов обучения с подкреплением», которые способствуют более эффективному использованию логических возможностей алгоритма.

Согласно данным Google, новая ИИ-модель успешно прошла тест «Последний экзамен человечества», который включает тысячи проверяемых академических вопросов по математике, гуманитарным и естественным наукам. Результат нейросети составил 34,8 %, в то время как алгоритм Grok 4 от xAI получил только 25,4 %, а OpenAI o3 — 20,3 %. Google утверждает, что Gemini 2.5 Deep Think также превосходит аналогичные модели от OpenAI, xAI и Anthropic в бенчмарке LiveCodeBench6, который включает сложные задачи по программированию.

В этих тестах ИИ-модель Google набрала 87,6 %, тогда как Grok 4 — 79 %, а o3 — 72 %. Gemini 2.5 Deep Think автоматически активирует необходимые ИИ-агенты для выполнения задач, таких как написание программного кода или поиск информации в интернете. По словам разработчиков, нейросеть способна предоставлять «значительно более длинные ответы» по сравнению с традиционными ИИ-моделями. В ближайшее время Google планирует открыть доступ к Gemini 2.5 Deep Think для ограниченной группы разработчиков через специальный API.

Регион: 

Рубрики: 

Заметили ошибку? Выделите ее мышкой и нажмите Ctrl+Enter!