Команда AI-редактора Cursor опубликовала подробный анализ своей мультиагентной системы, способной выполнять около 1000 коммитов в час. Эта система без человеческого вмешательства произвела 10 миллионов вызовов инструментов за неделю, в рамках тестирования веб-браузера на Rust. Путь к эффективной архитектуре оказался сложным и многоступенчатым. Первые попытки обеспечить равные роли для агентов не увенчались успехом: возникали проблемы с блокировками и производительностью.
Однако последующие схемы также столкнулись с трудностями. Окончательная архитектура схожа с традиционной командой разработчиков: корневой планировщик управляет задачами и распределяет их между агентами-воркерами, которые выполняют задачи в отдельных копиях репозитория. После работы они предоставляют полную отчетность. Один из основных выводов команды заключается в том, что строгие требования к корректности коммитов тормозят производительность. Вместо этого команда разрешила небольшие ошибки, что сохраняло общий уровень стабильным. Также было отмечено, что четкость первоначальных указаний важнее, чем сама модель системы.