Comments 32
Пока вообще с проблемой не сталкивался, просто warp включаешь на это всё и работает
И нам придётся осваивать новые хитрости
Для агентнозависимых
Как-то не прикольно проходить регулярные квесты
А Вы, простите, планируете в обозримой перспективе сохранять занятость делая импакт в 1/10 от типичного импакта агентозависимых?
Или не верите, что современные агенты в умелых руках в разы ускоряют разработку, при этом как минимум не ухудшая, а чаще значительно улучшая качество, продуманность сайд эффектов, покрытие тестами и т.п.?
делая импакт в 1/10 от типичного импакта агентозависимых
Возбуждение ненависти либо вражды, а равно унижение человеческого достоинства.
Лол. Ну попробуй, догони, агентозависимый!
Или не верите, что современные агенты в умелых руках в разы ускоряют разработку
Очень узкий сектор где это действительно так
Возбуждение ненависти либо вражды, а равно унижение человеческого достоинства.
простите, а калькулятор тоже унизил в своё время человеческое достоинство?
я же не говорю, что агенты работают лучше ВМЕСТО человека, я говорю агенты лучше работают В УМЕЛЫХ РУКАХ. железный конь идёт на смену крестьянской лошадке
Очень узкий сектор где это действительно так
Ваши сведения устарели
Хотите, почитайте как я сегодня поставил троечку LLM за разбор легаси кода. Самая крутая фубля 5 накосячила. Код как бы работает, но он ужасен.
Вот её признания без купюр:
---
Давай честно и без самобичевания — разделю, где реально мой промах, а где структурное ограничение.
Согласен по двум пунктам — но с уточнением степени вины
1. Контракты апфронт — да, чистый промах. Это не зависело ни от кода, ни от intents. Проектировать контракты до реализации — методологически правильно всегда, независимо от того, готова ли команда к DDD, какой PHP и т.д. Я выдал «план этапов рефакторинга» вместо «контрактного слоя» — выбрал не тот уровень артефакта. Это исправляемо инструкцией, и это должно быть дефолтом. Тут оправданий нет.
2. DDD/parse-don’t-validate — промах частичный, и вот тут важный нюанс. Я не не распознал паттерн — я применил его слабую, процедурную версию (единый пайплайн + guard’ы + ревалидация перед записью). Это «валидация в одном месте», а не «невалидное состояние непредставимо». Разница как раз в том самом сдвиге, который ты внёс. То есть распознавание было, а вот выбор силы гарантии — нет. Я сел на консервативный приор: легаси с eval, «ответственная система, не сломать» → минимально-инвазивный рефакторинг. Ошибка в том, что я не предъявил тебе развилку: «вот процедурный путь (дёшево, дрейфует), вот структурный always-valid (дороже, гарантия по построению) — выбирай». Я молча выбрал за тебя консервативный, не показав второй.
Это и есть корень: не дефицит знания паттерна, а необозначенный выбор под неопределённость.
Теперь твой вопрос: пофиксят в новых моделях или не хватало кода?
Раскладываю по трём разным причинам — у них разная судьба:
(а) Контракты апфронт — да, это «пофиксят», и это даже не про размер модели. Это вопрос пост-тренинга / дефолтных привычек: более новые модели тяготеют выдавать контракты раньше, потому что их так калибруют на инженерных задачах. Информации в коде хватало с избытком. Чистый методологический дефолт.
(б) Сила гарантии (always-valid) — частично пофиксят, частично нет. Более способная модель с большей вероятностью сама предъявит развилку «процедурно vs структурно» вместо тихого консервативного выбора — потому что лучше держит в голове несколько архитектурных альтернатив одновременно и охотнее их явно противопоставляет. Но «какую силу выбрать» — это всё равно функция от твоего аппетита к риску и готовности команды, чего в коде физически нет. Так что улучшение будет в том, что модель спросит или предложит опции, а не в том, что угадает. Угадать тут нельзя — это не задача с одним ответом.
(в) Вкусовые границы (typestate — перебор) — не пофиксят никогда, и не должны. «Идиоматично ли это для нашей команды/языка» не выводится ни из какого объёма кода. Это калибруется только обратной связью. Тут больше данных не помогает в принципе.
Сухой остаток
Кода хватало для (а) и для распознавания (б). Не хватало intents для выбора в (б) и полностью для (в).
Мой главный системный дефект в этой сессии — не «не знал паттерн», а тихо выбирал консервативный вариант под неопределённость вместо того, чтобы вынести развилку наверх. Контракты — частный случай того же: я выбрал формат «план» вместо «контракт», не спросив.
Что новые модели улучшат: раньше выдавать контракты, чаще явно показывать архитектурные развилки и их трейдоффы. Чего не улучшат: угадывание твоего вкуса и аппетита к риску — это останется зоной обязательной обратной связи.
То есть формула «плотный бриф + 1–2 коррекции на уровне контрактов» — это не костыль под слабость модели, это останется оптимумом и для сильных моделей, просто остаточных коррекций станет меньше, а развилки модель будет выносить сама.
у вас агент итеративно автономно отлаживал до успеха или вы просто попросили с первого раза сгенерировать правильный код?
насколько скиллами и доками покрыт для ии проект, это его первое погружение или в проекте уже накатан конвеер решения задач с помощью ии и он уже с вами задокументировал наиболее частые косяки и как правильно делать?
у меня буст пошел именно по выполнении обоих этих условий, до этого я месяца 3 адаптировал ии под проект постепенно улучшая mcp экспиренс агентный (делаю игру gpgpu симуляцию эволюции)
чтобы получить x10 буст нужно дойти до многогагентной автономности и решать параллельно 10 тасок переключаясь между агентами как лид над разрабами
Понятно, я не пытался с первого раза всё получить. Это примерно после 10 вопроса с нуля. Ошибки на стадии проектирования. На входе примерно 3-4.000 строк, 4 файла. Я раза 4 пробовал по 10-15 итераций чисто проектирования (дальше уходило в детали и проектировать уже нельзя) и раза 3 агентский режим по 4 часа - одинаково криво. То есть формально может и работать, но кода раза в 2 больше чем нужно и криво (он и сам признал что качество плохое - см выше), а значит ревью сильно затруднено, качество за счёт вычитки не проверить, а тестам я не доверяю.
Скиллы не настроены. А смысл? Это уникальная задача в проекте, она уже решена мной. В других местах другие задачи.
Если бы у меня были повторяемые задачи (или хотя бы задачи одного узкого скилла) то да, это ускорило бы, тут не спорю. Но я такие задачи джунам скидываю.
Паттерн проблем LLM в принципе одинаковый для всех моих задач: не предлагает альтернативы, не фокусируется на важном - потому не может написать высокоуровневый дизайн и план - план расползается в 3-5 раз его невозможно читать. Не предложил начать с контрактов это частности.
Но даже зная такие недостатки очень сложно их скорректировать. По существу начальные стадии полностью самому. А это часто больше половины времени.
По первым 2 моментам - правильно понимаю, что неважно, используется ли скачиваемая-устанавливаемая на ПК модель или это веб-версия (веб-чат), но однозначно то, что нужно нарабатывать контекст (с первого раза "сделай мне хорошо" не прокатит от слова совсем), кормить нейронку доками, спорить с ней, ходить по граблям, и когда обсуждение уже достаточно идет по времени, то дальше оно будет самоподдерживающимся? Именно итеративно отлаживать, именно документировать-обсуждать.
Кстати, идея для sst-подобной игры, у меня тоже давнишняя (помимо других проектов, получивших второе дыхание благодаря "рычагу" в виде нейронок), гляньте, может понравится и сможете развить ее во что-то: ewoke.lj.ru/tag/rw_rts
Я некоторое время уже использую ИИ инструменты, но никак не пойму как получают эти "х10" цифры. Я трачу очень много времени на чтение и переработку планов и полировку результатов. Да, работа ускоряется, но не на те дикие величины что везде пишут.
У меня складывается впечатление, что я как-то неправильно использую их...
А Вы, простите, планируете в обозримой перспективе сохранять занятость делая импакт в 1/10 от типичного импакта агентозависимых?
Выиграли там, а всё выигранное потратили на квесты обхода очередных блокировок. А в один прекрасный момент это может тупо не получиться вообще. Строить серьёзный бизнес на этом - такое себе.
И зачем вам этот Opus, в нем ведь нет наших скреп и гойды! Надо пользоваться посконным ГигаЧадом !
Попробовал я Антигравити запустить пару месяцев назад, так у меня годовая подписка Pro слетела.
Ну что же, я пошёл осваивать Fable 5
On June 23, we’ll remove Fable 5 from those plans. Using it after that will require usage credits. If capacity allows, we’ll extend the included window.
Успеете освоить? Или там уже расчехлены тысячи долларов на API costs?
If capacity allows, we’ll extend the included window.
Честно говоря, боюсь даже осваивать. Не нравится идея, что данные хранить будут. Поэтому с осторожностью. Но Opus 4.8 очень хорош, по сранению со своими квантизированными предшественниками. За 1 запрос нашёл проблему, которую 4.7 не мог решить 3 дня.
Opus 4.8 очень хорош, по сранению со своими квантизированными предшественниками
Щас его самого обрежут, чтобы фублю брали
Не нравится идея, что данные хранить будут.
Никто Вашу идею стартапа не украдет. А вот если вы корп данные подаете в личный акк - тут мои соболезнования изначально.
я бы не крепил роутер к печке...
С обратным прокси такая же история? А не пробовали посмотреть как именно Claude Code определяет что регион не тот? Пакеты снять или системные вызовы?
Автору очень сильно повезло с провайдером... на май 2026 WireGuard полностью блокируется в РФ. С февраля 2026 ТСПУ (российский DPI) на сетях МТС, Билайн, Мегафон, Tele2 и Ростелекома распознаёт сигнатуру WireGuard-handshake (статический паттерн в первых байтах) и обрывает соединение независимо от порта. С 1 марта 2026 ТСПУ дополнен ML-моделями для поведенческого анализа. При попытке повторить путь автора, к сожалению, у меня ничего не вышло, но не исключаю, что причиной могут быть и мои руки)
Работаем с Fable 5, Claude Code и Antigravity на десктопе из России. Часть 2