Comments 2

Полезная статья. Тезис "правило держится ровно настолько, насколько оно проверяемо", пожалуй, главное, что стоит понять каждому, кто начинает работать с агентами. Добавлю от себя штуки, которые уменьшили число ошибок агента. Часть из них как раз про проверяемость, часть честно вероятностные, но дешёвые.
1. Плагин superpowers с brainstorm перед реализации любой фичи, даже самой мелкой пишу с ним спеку. Это можно сказать гарантия того, что решена нужная задача, а не абстрактная.
2. Обращение агента ко мне по имени в каждом сообщении. Это канарейка: как только обращение пропало, системный промпт вытеснился из контекста, ровно как вы описываете, и пора начинать новую сессию.
3. Система очков. Забыл обращение -10, не верная итерация -5, верная итерация +1. Трюк чисто вероятностный, но, как оказалось, модели обожают зарабатывать очки Точность растет.
4. Уникальный нейминг и грамотное описание функций в комплекте с плагинами по типу дерева памяти. Уменьшает расход токенов.
5. Ваш пункт про свои анализаторы подтверждаю с другого конца: если инвариант это "ключ, зарегистрированный в одном реестре, обязан быть и в парных" (Name объявлен в A -> должен быть в B и C), достаточно простого теста на двустороннюю регистрацию. Агент нарушает, тест бьет по рукам, документация не нужна.
6. Hook на важные действия или обязательные запреты. Как вы заметили, Claude.md и прочие промпты носят лишь рекомендательный характер. Хук же неумолим и обязателен к выполнению.
7. Для типовых задач вместо ссылок на блоки кода с примерами, стоит выносить в Skill набор инструкций с примерами кода, тогда агент работает в разы точнее.
Компилятор как первый ревьюер: петля верификации Go‑кода, который написал агент