Google анонсировала запуск режима Deep Think для своей модели Gemini 3, который ориентирован на решение сложных математических, научных и логических задач. Этот режим использует параллельное рассуждение, позволяя модели одновременно исследовать несколько гипотез и выбирать наиболее эффективное решение. На бенчмарке ARC-AGI-2 Deep Think продемонстрировал результат в 45.1%, что значительно превышает показатели GPT-5.1 (17.6%) и обычной версии Gemini 3 Pro (31.1%).
В тесте Humanity’s Last Exam, который включает 2500 вопросов по математике и наукам, Deep Think показал 41%, в то время как у GPT-5.1 результат составил 26.5%. На научном тесте GPQA Diamond модель достигла 93.8%, в то время как её конкурент получил 88.1%. Ранее Gemini 2.5 Deep Think завоевала золото на Международной математической олимпиаде (IMO 2025).
Архитектура Deep Think остается неизвестной, но известно, что в ней параллельно работают несколько экземпляров Gemini 3 Pro, подготавливающих разные варианты решений, которые затем оценивает арбитр. Это объясняет длительное время генерации и высокую стоимость подписки в $250 в месяц на Google AI Ultra. Мультиагентные системы становятся все более популярными среди разработчиков, что требует значительных вычислительных ресурсов, что отражается в ценовой политике компаний.