Команда AI-редактора Cursor поделилась результатами разработки своей мультиагентной системы, которая смогла продемонстрировать впечатляющие результаты — около 1000 коммитов в час и 10 миллионов вызовов инструментов за неделю без участия человека. В качестве тестовой платформы был использован веб-браузер на Rust.
Путь к эффективной архитектуре оказался нелегким: первоначальный подход, при котором агенты имели равные роли и общий файл для координации, потерпел неудачу, так как агенты сбивались и не могли управлять блокировками. Далее пытались использовать модель «планировщик — исполнитель — воркеры — судья», но она оказалась слишком жесткой. В конечном итоге была выбрана структура, напоминающая команду разработки, при которой корневой планировщик курирует задачи и создает подпланировщиков для их распределения. Этот подход позволил агентам работать автономно и эффективно обмениваться информацией по завершении задач.
Особенно интересным стало обнаружение, что 100-процентная корректность коммитов замедляла систему. Обнаруженные ошибки быстро исправлялись, а стабильность общего уровня сохранялась. Команда также выявила, что точные начальные инструкции важнее самой модели. Исследователь Уилсон Лин советует воспринимать модель как нового сотрудника, знакомого с инженерией, но не с конкретной кодовой базой.
