Компания Google анонсировала открытие доступа к режиму Deep Think для своей модели Gemini 3, который ориентирован на решение сложных задач в области математики, науки и логики. Данный режим использует метод параллельного рассуждения: модель одновременно анализирует несколько гипотез и выбирает наиболее подходящее решение. На бенчмарке ARC-AGI-2, который оценивает способность решать незнакомые абстрактные задачи, Deep Think продемонстрировал результат в 45.1%, в то время как GPT-5.1 показал лишь 17.6%, а «обычная» Gemini 3 Pro — 31.1%.
В тесте Humanity’s Last Exam, состоящем из 2500 вопросов по различным дисциплинам, Deep Think достиг 41% без применения дополнительных инструментов, что значительно превосходит 26.5% GPT-5.1. В научном тесте GPQA Diamond результат составил 93.8% против 88.1% у конкурента. Режим Deep Think работает на базе нескольких экземпляров Gemini 3 Pro, которые готовят альтернативные решения, а затем модель-арбитр выбирает лучшее. Это объясняет длительное время генерации, а также высокую стоимость подписки на Google AI Ultra в $250 в месяц. Мультиагентные системы становятся трендом среди ведущих разработчиков, и они требуют значительных вычислительных ресурсов, что также отражается на ценах подписок.


