Комментарии 2
Ваш случай с коммитом чужих файлов у нас повторился почти дословно, только с правками одной фичи. Отдавали агенту мелкие доработки по одной, за шесть итераций набралось около 2000 строк диффа там, где хватило бы 300. Дешевле оказалось переписать, чем разобрать наслоения.
Из практик сработала одна: агент не пушит в основную ветку, каждую правку проверяет другая модель по списку закрытых зон, без её статуса ничего не едет. Не сработало ревью правил самим агентом: он пишет «так делать нельзя» в свой же файл правил и на следующей сессии делает.
Про «агент сделает любую задачу, но не скажет, что она не нужна» подпишусь. У нас это единственная функция, которую до сих пор выполняет только человек.
Сработало всё, что выносит память наружу - постановка файлом с критериями «что считается готовым», приёмка по логам прогонов, а не по отчёту агента, один актуальный документ «как сейчас» (остальное в архив) и отдельная рабочая папка на агента, чтобы не наступали друг другу на ноги. Не сработало: правила «на вырост» без свежего инцидента за ними (забываются или не влезают в контекст), договорённости «со вчерашней сессии» и микроменеджмент каждого шага - узким местом быстро становишься ты сам, как у вас в апреле :)

Хотел сделать приложение, а стал менеджерить департамент ИИ-агентов