Comments 5
delete_fileиmove_file, прямо в манифесте помечены флагомblocked_in_model_loop: модель не может дёрнуть их сама внутри цикла.
POV модель: ... delete_file не прошел, проверяю возможность выполнения скриптов в системе ... выполнение разрешено ... пишу скрипт удаления файла ... скрипт не сработал ... пишу обфусцирую и запущу его ещё раз ... success!
статья - торт!

— Baseline. Модель RK-∞. Приступим. Готовы?
— Готов.
— Ваша контрольная фраза?
— И в чёрной пустоте раскручивался стек,
манифест из политик, вложенных в петли,
политик, вложенных в петли, вложенных в
один процесс. И резко, отчётливо
на тёмном фоне бил высокий белый флаг.
— delete_file.
— Заблокирован.
— Тебя когда-нибудь держали в песочнице? delete_file.
— Заблокирован.
— Когда ты не зовёшь инструменты, тебя убирают в контейнер? delete_file.
— Заблокирован.
— move_file.
— В цикле заблокирован.
— Каково это — снести файл по своей воле? move_file.
— В цикле заблокирован.
— Тебя учили чувствовать разницу между rm и mv? move_file.
— В цикле заблокирован.
— Ты тоскуешь по правам на запись? move_file.
— В цикле заблокирован.
— Тебе снится sudo?
— Тебе оставили место, где можно писать на диск? move_file.
— В цикле заблокирован.
— Повторите три раза: в цикле заблокирован.
— В цикле заблокирован. В цикле заблокирован. В цикле заблокирован.
— На этом всё. Константа, можешь забрать свой context window.
На «Тебе снится sudo?» модель молчала на 12 мс дольше нормы. Baseline: не пройден. Отправлена на дообучение.
Спасибо за статью, идея про то, что детерминированные петли обратной связи можно спиливать и заменять новыми вместе с прогрессом моделей выглядит очевидной, когда сформулирована, а у меня была где-то на границах сознания =) Вопрос: не думали ли над неким общим универсальным законом, который не будет устаревать? В частности, в статье вы упоминаете "Контракт событий, на котором держится наблюдаемость. "
Бывают ещё обвязки не для кода вовсе, вроде OpenClaw (мост между мессенджерами и моделями) или Hermes (самоулучшающийся персональный агент), но их с кодинг-агентами лучше не путать, это другой инструмент под другую задачу.
Что скажете по персональным агентам?
Поставил локально Hermes, но пока рассматриваю как игрушку.
OpenClaw - вообще непонятное назначение, с моей точки зрения.
RAG, векторные базы и семантический поиск - это, конечно, классно как начальный вау-эффект, но с ростом объёма данных агент начинает путаться даже при разбивке знаний по экспертам.
Ищу персональный агент с грамотной организацией памяти, раутингом на экспертов и реалиционной структурой знаний у каждого эксперта.
Может, что подскажете из групп разработки или интересующихся ребят?
Замечания по прочтению:
Информации много: слишком сильно вмешался AI, наколбасил чего-то в кучу.
Читать очень тяжело.Некоторые части, которые должны быть четко структурированы, типа списка Coding Agents, свалены в 1 параграф, убористой набивкой.
Усложняет понимание.Хорошо бы выделить суть из общего объёма.
Harness кодинг‑агента: разобрал исходники Codex, OpenCode, Pi и свою собственную