Стартап Pace, разрабатывающий ИИ-агентов для страховых компаний, провел тестирование модели GPT-5.4 на устаревших легаси-порталах, которым уже более 20 лет. Компания отметила, что модель успешно справилась с задачами: она точно кликает по необходимым элементам, сохраняет контекст на протяжении многих действий и запоминает расположение интерфейса между сессиями. Страхование представляет собой сложную область для компьютерного использования, где рабочие процессы могут включать сотни шагов. По сравнению с предыдущими версиями, GPT-5.4 превосходит их в удерживании контекста и точности выполнения задач. OpenAI утверждает, что новая модель имеет контекстное окно объемом 1,05 миллиона токенов. Pace выделяет четыре основных улучшения: точность кликов, способность рассуждать на длинных цепочках, скорость тестирования и память о пространственной раскладке интерфейса. На бенчмарке OSWorld-Verified GPT-5.4 показала 75% успеха, что выше человеческого показателя. Pace уже сотрудничает с Prudential Financial, внедряя ИИ-агентов для автоматизации обслуживания полисов, однако надёжность в производственной среде остаётся вопросом, требующим решений.