Модели искусственного интеллекта GPT-5 и Gemini 2.5 Pro достигли уровня «золота» в задачах Международной олимпиады по астрономии и астрофизике (IOAA). Исследователи протестировали языковые модели на заданиях IOAA 2022–2025 годов, оценив их ответы согласно официальным критериям. Интересно, что набор IOAA-2025 был создан лишь в августе 2025 года, что указывает на то, что модели не использовали заранее подготовленные ответы, а решали задачи осмысленно. Эксперимент включал теоретический тур и анализ данных, при этом оценки были максимально приближенными к реальному судейству. GPT-5 демонстрировал 84,2% в теории и 88,5% в анализе данных, в то время как Gemini 2.5 Pro показал 85,6% и 75,7% соответственно. Другие модели, такие как OpenAI o3 и Claude, показывали разные результаты, особенно в анализе данных. Авторы исследования подчеркивают необходимость улучшения мультимодальности и визуального восприятия для дальнейшего прогресса в решении задач с визуальным контентом.