Pull to refresh
16K+
12
Янина Шкуропат@datamafia

Практикую Discovery\Delivery\Growth\Data Analytics

5
Rating
11
Subscribers
Send message

"Так, а где контроль то, что LLM сделала все правильно?" - удивительно, что у вас столько времени здесь писать и нет времени погуглить (прочитайте про агентские циклы в ai-native sdlс, про то, как выстраивают evals и тд.) Я просто по второму разу вам отвечаю, что весь воркшоп про то - как выстроена система контроля, чтобы агенты сделали все правильно.

  • Автоматизация в том, что у коллег уже ai-native разработка и код руками они не пишут, не ревювят, и не тестируют, и результат - 800 PR как раз в том, что все скиллы и инструменты уже настроены.

  • Вы, видимо, не поняли, что Лорен все рассказала по тезису - основная проблема в доверии и как они ее решают, чтобы один человек мог управлять тысячами агентов.

  • Агенты умеют решать конкретные задачи без участия человека, поэтому у нее сейчас и 800 PR, и сотрудник в Курсоре вовлекается на уровне evals и governance.

  • Ну и вот это ваше высказывание "Описанный подход опирается на предположение, что LLM достаточно умна, чтобы сделать все правильно при наличии поданного контекста" - вообще не в тему ) Всю статью она рассказывает, как они выстроили тулзы контроля, чтобы LLM все сделала правильно )

Антропики говорят, что у них 2 вида харнессов - Evaluation Harness и Agent Harness. Можете порисерчить что-зачем.

По пункту 1. Если вдруг решите взять у кого-то интервью по телефону, вживую или онлайн, дам вам промо в одном неплохом сервисе на 10 часов записи\расшифровки. Точность распознавания на русском - 96%

Да, очень активно дистрибутируют по всем пабликам. Удивительно, что Хабр не банит копипасту

Коллеги, вы большие молодцы 🔆 С 20-летием!

У Антропик шикарный пиар ) Готовятся к IPO

Про IPO согласна, это всегда миссия - рост выручки любой ценой. Про это и автор книги говорит.

Согласна. Но еще и до ИИ литературные описания на полстраницы в стиле Толстово уже казались мне нудными. Хотя давно не встречала людей с красивой насыщенной разговорной речью

Согласна, СС загнивает, далеко им до нашего флагмана Гигачата )

Согласна, что выручка 9млрд за прошлый год это мизер, пытаюсь вспомнить какие у нас стартапы побольше такой мелочи заработали в 2025

Ну вот как-то пет проект набрал больше тысячи корпоративных клиентов с чеком $1+ млн. Пытаюсь вспомнить кейсы у наших локальных профессионалов такое масштабирование

Мне кажется, что у них название ролей чисто номинальное, просто есть понимание, кто "главнее" и кто за что отвечает. А так на видео выглядит так, что интервью берут у ИИ-аватара Кэт - идеальная структурированная речь, практически без эмоций )

У меня в BrandAnalytics было 10% шума и 20% репостов. Если у вас выше %, то плохо настроили семантическое ядро. Репосты можно в отчёте быстро почистить фильтром.

Пока коренных изменений нет, но я не сдаюсь от каждодневных "нет" ) Если решите стартануть свое дело, буду рада поделиться вдохновением и поддержкой. Всегда очень сложно начинать с нуля

Поправляйся!

Information

Rating
1,233-rd
Location
Россия
Registered
Activity

Specialization

Менеджер проекта, Менеджер продукта
Старший
Python
Git
PostgreSQL
Английский язык
SQL