Разработка автономных кодинг-агентов: успешные эксперименты Cursor

Разработчики из Cursor обнародовали итоги эксперимента по масштабированию автономных кодинг-агентов. В ходе проекта было запущено сотни агентов, которые работали одновременно в течение нескольких недель, написав свыше миллиона строк кода. Основная цель исследования заключалась в том, чтобы выяснить, возможно ли ускорить решения задач, которые обычно требуют месяцы работы команд разработчиков.

Однако они столкнулись с проблемами координации — когда агенты получили одинаковый статус и возможность самостоятельно делить задачи, лишь двадцать из них проявили высокую продуктивность, в то время как остальные ждали освобождения блокировок. Без иерархии агенты часто избегали сложных задач. В результате была введена система ролей: планировщики анализируют код и формируют задачи, в то время как воркеры их выполняют.

Для тестирования новой системы агенты на GPT-5.2 получили задание по созданию браузера с нуля, и за неделю они сгенерировали более трех миллионов строк кода. Хотя браузер демонстрирует высокую скорость работы с простыми сайтами, до уровня WebKit и Chromium ему еще далеко. CEO Cursor, Майкл Труэлл, отметил, что GPT-5.2 показала лучшие результаты в длительных автономных задачах, оставаясь сосредоточенной и следуя инструкциям.

Полученный главный вывод команды заключается в том, что качество промптов важнее выбора модели или архитектуры. Координация сотен агентов потребовала множества экспериментов с инструкциями, и хотя система еще не идеальна, результаты оказались более оптимистичными, чем ожидалось: масштабирование действительно работает.

Понравилась статья? Поделиться с друзьями: