Pull to refresh
2
Vsevolod Kobzar@vkobzar

Основатель SaaS-проектов на стыке ИИ и B2B

2
Subscribers
Send message

Хороший вопрос. Очередь заодно работает журналом: закрытая задача не удаляется, а помечается done и остаётся в файле. Так держится история - кто кому что передал, когда взяли в работу и когда закрыли. Живым агентам хук отдаёт только открытые, done лежит рядом как аудит-трейл: если что-то пошло не так, можно поднять весь тред и увидеть, где именно застряло. Разрастается медленно, места не занимает, старьё при желании выносится в архив.

По цифрам вы прочли не то и не так) Маржу и P&L считает как раз детерминированный код, а не LLM. Нейросеть у нас деньги не считает, они комментируют уже посчитанное. Это тот самый принцип, который вы отстаиваете, мы его и держим.

А вот дальше вы подняли настоящую тему. ИБ и LLM в контуре разработки, supply-chain, что реально проверяет СБ. И это не на нару слов в коментах, это на отдельную статью или пост. Подписывайтесь, следующий разбор хочу сделать как раз про это. Где в связке «LLM плюс разработка» настоящие риски, а где мифы. Попрошу коммент для статьи у senior-специалиста по DFIR (реагирование на инциденты, разбор malware, практика в США), чтобы был взгляд реального практика по безопасности, а только не фаундер-хайп. Ваши возражения по supply-chain там и разберём предметно.

Спасибо, это первый развёрнутый технический разбор в треде и по делу. Пройдусь по трём пунктам. Где-то вы правы, где-то я, похоже, сам написал так, что читается криво.

Безопасность. Смешаны две вещи: чем я пишу код и куда текут данные клиента. Шина локальная, markdown и хуки на моей машине, носят описания задач, а не данные продавцов. В Anthropic при разработке уходит мой исходник, как у всех, кто пишет на Cursor или Copilot. А P&L и логи маркетплейсов клиента через шину и Claude Code не проходят вообще: продакшн на своём бэкенде, AI-вызовы в продукте идут через отдельного российского провайдера, разработку веду не на боевых данных. Клиентские данные при этом в РФ-контуре: и прод, и AI-провайдер российские, локализация ПДн по 152-ФЗ на нашей стороне закрыта, из российской юрисдикции они не уходят. СБ клиента смотрит, куда течёт ЕГО данные в продукте, а не в какой IDE писан код.

Оверхед. Хук инжектит не файл на 1002 задачи, а только open-строки конкретного агента, несколько штук; done не подаётся вообще. А 678 МБ это размер локального транскрипта сессии на диске, а не пейлоад, уходящий в API на каждом шаге: в запрос летит ограниченное контекстное окно, и оно кэшируется. Окно умерло по другой причине: долгая Opus-сессия накопила собственные thinking-блоки и на ресьюме уперлась в 400 thinking blocks cannot be modified. Лечится это той самой save-state. Повторяемый контекст идёт через prompt caching, чтение из кэша стоит порядка 10% обычного токена, так что старые шаги обходятся в десятую часть цены. Про «чистые запросы через Messages API»: как принцип верно, и для headless-оркестрации я бы так и сделал. Но окна шины это интерактивные dev-сессии, где агент читает файлы и гоняет тесты. Другой слой оркестрации.

Автономность. Тут вы правы, и я это в статье прямо написал, раздел «Чего здесь нет»: агента бужу руками, ночью 12 ролей не работают, это осознанный выбор. Effort-флаг это «агент подсвечивает, решение об апгрейде моё», а не делегирование оценки риска модели. И на суждение одной модели риск не завязан: деньги-критичный код проходит через веер независимых субагентов, обязанных опровергнуть находку. Те самые пять платёжных багов поймал механизм, а не сознательность нейросети.

Vendor lock-in. Зависимость от чужих API в принципе есть у всех, кто на них строит, спорить глупо. Но «тупик в проде из-за Anthropic» мимо: в продакшене в Anthropic не уходит ничего, продукт ходит к AI через российский коммерческий шлюз, данные в РФ-контуре, провайдер сменяем (и ротируемый). В облако Anthropic попадает только мой исходник при разработке, потому что код я пишу в Claude Code. Это моя IP и мой выбор инструмента, сменить IDE можно без единой правки в продукте. А шину я и так не продаю, это моя личная внутренняя оснастка и рабочий инструмент.

По пунктам 1 и 2, если есть чем возразить по фактам, послушаю с интересом.

«Скажу, ну доделай давай» 😄 вот на этой фразе и написана вся статья. Первые пару недель я ровно так и жил. Потом «доделай давай» упёрлось в окно на 678 МБ и 400 thinking blocks cannot be modified, и пришлось строить очередь.

WB API «попросить добавить в среду» звучит красиво, но по факту это будет пару недель сверки минимум: врать продавцу на его же деньгах нельзя. Амазон подождёт до четверга 😉

План хороший, серьёзно. Просто между «доделай давай» и работающим saas живут те самые 60 дней (а у когото и годы). Удачи в понедельник.

Если будете копировать - два места, где я потерял время зря:

Первое: не тратьте вечер на переменные окружения, если работаете в панелях одного окна редактора. Они делят окружение процесса, идентичности не получится.

Второе: механику сохранения состояния добавьте сразу, а не после того как потеряете окно. Там пятнадцать строк, а стоит она двух суток работы.

Расскажите потом, что вышло.

Information

Rating
Does not participate
Location
Россия
Registered
Activity

Specialization

Менеджер продукта
Ведущий
Saas
Управление продуктами
LLM
Нейронные сети
Python
Анализ данных
Электронная коммерция
B2B
Развитие бизнеса
Проектирование архитектуры приложений