Команда AI-редактора Cursor презентовала глубокий анализ своей мультиагентной системы, способной генерировать до 1000 коммитов в час, что соответствует 10 миллионам вызовов инструментов за неделю без человеческого вмешательства. В качестве тестового проекта был выбран веб-браузер на языке Rust.
Процесс создания рабочей архитектуры был непростым. Первая попытка, основанная на равенстве ролей и общем файле координации, оказалась неудачной: агенты теряли контроль и путались в состояниях, а производительность 20 агентов равнялась успехам одного. Несмотря на улучшение со схемой «планировщик — исполнитель — воркеры — судья», система сталкивалась с неэффективностью самого медленного исполнителя.
Однако финальная модель напоминала классическую команду разработчиков. Корневой планировщик контролировал общую задачу, делегируя работу подпланировщикам. Воркеры работали независимо, предоставляя не только отчеты, но и замечания о выполненной работе. Были сделаны важные выводы о том, что стремление к идеальной корректности коммитов тормозит процесс. Cursor разрешил небольшой процент ошибок, что способствовало быстрому исправлению недостатков другими агентами.
Кроме того, команда обнаружила, что качество исходных инструкций критически важно для работы модели. Нечеткие задания приводили к неэффективной работе агентов. Уилсон Лин, автор исследования, сравнительно оценил агента как нового, высококвалифицированного сотрудника, которому требуются четкие указания для успешной работы.