Pull to refresh

Comments 5

delete_file и move_file, прямо в манифесте помечены флагом blocked_in_model_loop: модель не может дёрнуть их сама внутри цикла.

POV модель: ... delete_file не прошел, проверяю возможность выполнения скриптов в системе ... выполнение разрешено ... пишу скрипт удаления файла ... скрипт не сработал ... пишу обфусцирую и запущу его ещё раз ... success!

статья - торт!

— Baseline. Модель RK-∞. Приступим. Готовы?
— Готов.
— Ваша контрольная фраза?
— И в чёрной пустоте раскручивался стек,
манифест из политик, вложенных в петли,
политик, вложенных в петли, вложенных в
один процесс. И резко, отчётливо
на тёмном фоне бил высокий белый флаг.

— delete_file.
— Заблокирован.
— Тебя когда-нибудь держали в песочнице? delete_file.
— Заблокирован.
— Когда ты не зовёшь инструменты, тебя убирают в контейнер? delete_file.
— Заблокирован.

— move_file.
— В цикле заблокирован.
— Каково это — снести файл по своей воле? move_file.
— В цикле заблокирован.
— Тебя учили чувствовать разницу между rm и mv? move_file.
— В цикле заблокирован.
— Ты тоскуешь по правам на запись? move_file.
— В цикле заблокирован.
— Тебе снится sudo?

— Тебе оставили место, где можно писать на диск? move_file.
— В цикле заблокирован.
— Повторите три раза: в цикле заблокирован.
— В цикле заблокирован. В цикле заблокирован. В цикле заблокирован.
— На этом всё. Константа, можешь забрать свой context window.

На «Тебе снится sudo?» модель молчала на 12 мс дольше нормы. Baseline: не пройден. Отправлена на дообучение.

Спасибо за статью, идея про то, что детерминированные петли обратной связи можно спиливать и заменять новыми вместе с прогрессом моделей выглядит очевидной, когда сформулирована, а у меня была где-то на границах сознания =) Вопрос: не думали ли над неким общим универсальным законом, который не будет устаревать? В частности, в статье вы упоминаете "Контракт событий, на котором держится наблюдаемость"

Вечного закона нет, есть привычка спрашивать, что делает костыль: подпирает слабость модели или держит границу системы? Первое на выброс, второе несущее, и наблюдаемость из второго лагеря.

Бывают ещё обвязки не для кода вовсе, вроде OpenClaw (мост между мессенджерами и моделями) или Hermes (самоулучшающийся персональный агент), но их с кодинг-агентами лучше не путать, это другой инструмент под другую задачу.

Что скажете по персональным агентам?
Поставил локально Hermes, но пока рассматриваю как игрушку.
OpenClaw - вообще непонятное назначение, с моей точки зрения.

RAG, векторные базы и семантический поиск - это, конечно, классно как начальный вау-эффект, но с ростом объёма данных агент начинает путаться даже при разбивке знаний по экспертам.

Ищу персональный агент с грамотной организацией памяти, раутингом на экспертов и реалиционной структурой знаний у каждого эксперта.

Может, что подскажете из групп разработки или интересующихся ребят?

Замечания по прочтению:

  • Информации много: слишком сильно вмешался AI, наколбасил чего-то в кучу.
    Читать очень тяжело.

  • Некоторые части, которые должны быть четко структурированы, типа списка Coding Agents, свалены в 1 параграф, убористой набивкой.
    Усложняет понимание.

  • Хорошо бы выделить суть из общего объёма.

Sign up to leave a comment.

Articles