Команда Cursor опубликовала итоги эксперимента, в ходе которого масштабировались автономные кодинг-агенты. В рамках проекта работали сотни агентов одновременно, которые на протяжении нескольких недель написали более миллиона строк кода. Основной задачей было выяснить, возможно ли сократить сроки выполнения задач, которые традиционно требуют месяцы работы команды разработчиков.
Однако возникла проблема с координацией: агенты, имея равный статус, делили задачи неэффективно, в результате чего лишь двадцать из них работали продуктивно. Без четкой иерархии они избегали сложных задач. Чтобы улучшить ситуацию, команда внедрила разделение ролей: планировщики исследуют код и формируют задачи, а воркеры их выполняют.
Для тестирования новой системы агенты на базе GPT-5.2 получили задание создать браузер с нуля, и за неделю сгенерировали более трех миллионов строк кода, включая рендеринг на Rust. По словам CEO Cursor, браузер демонстрирует высокую скорость рендеринга простых сайтов, хотя до уровня WebKit или Chromium еще далеко.
Также было отмечено, что GPT-5.2 лучше справляется с долгосрочными задачами, чем другие модели. Главный вывод команды: важность промптов превышает выбор модели. Несмотря на необходимость дальнейшей оптимизации, результаты эксперимента обнадеживают — масштабирование работает.


