Материальное подкрепление безусловно влияет на мотивацию. Ее убивают цели и видение результатов, которые обычно вместе с ней стараются навязать (за что собственно платить).
Ошибки при обучении необходимы - на ошибках учатся. Это как топливо. Убираете право на ошибку и ни кто больше ни чему не учится. Все только делают умный вид.
Я после школы и курсов не мог разговаривать на английском, боясь сказать что-то не так или не то. Там за ошибку сразу ставили плохую оценку. А если промолчать, то ни чего не будет. Вот и учился молчать. Начал разговаривать только переехав заграницу. Оказалось, что ломаный английский это язык на котором говорит половина Европы, практически вся Индия, Австралия, Канада с таким же французским, а ещё - изрядная часть самих британцев. Стал просто разговаривать, как все.
В обучении классно работает, когда полученные знания можно тут же применять на практике. Обучение впрок работает плохо. Создавайте среду из которой можно добывать знания и где их можно применять.
Такой экскаватор нужно сперва собрать (харнесы, плагины, скиллы, hooks, mcp, lsp), проложить дороги (rules, AGENTS.md, semantic knowledge), научиться с ним управляться (промпт инжениринг, SDD, ревью), регулярно заправлять (subscriptions), постоянно наблюдать за показателями и обслуживать (agent evals, observability). Это все окупается, только когда у вас конвейер. Ну либо вело экскаваторостроение является вашим хобби.
Разбираться в продукте (бизнесе, маркетинге, саппорте, процессах) и в коде - все ещё разные скиллы. Агенты помогают закрыть, условно, 20% незнания. Но если вы не смыслите в домене ни чего - они бесполезны. Product Engineers / Forward Deployed Engineers появляются лишь в специфичных ситуациях.
Много проблем возникает на уровне коммуникации между людьми, когда нужно искать не ответы, а компромиссы - договариваться. С помощью агентов можно быстро делать презентабельные презентации, но в целом от них толку мало.
Агенты удобны в кодинге, когда изменение легко локализовать и проверить. То есть, инженерная культура на проекте должна быть безупречной. Поэтому взрослые ребята теперь поставляют каждый день и нахваливают. У большинства же нет ни квалификации, ни денег для инвестиций в харнесы такого порядка. А без них агенты это стадо диких коней, которые норовят снести вам все на своём пути.
разнообразие управляющей системы должно быть не меньше разнообразия управляемого объекта или окружающей среды
Пасти стада агентов - дело не хитрое. В случае форсмажора пастух должен быть способен выдать решение на любую нештатную ситуацию. Но большую часть рабочего времени он сидит в тени уютного клена, наблюдая за своими барашками и развлекая себя игрой на дудочке, чтобы не помереть от тоски.
Работа в режиме meat proxy это не плохо - это рутина, как следствие улучшения процесов. Правда иногда приходится что-то мудрить.
Ночью у животных в свете фар видно лишь сверкающие глаза. Во всем остальном они эволюционно заточены ни чем не выделяться - иначе как охотиться или прятаться. Поэтому я зарекся ездить в темное время суток по трассе без особой необходимости.
Экспортные ограничения и связанные с ними обязательства - часть реальности https://www.anthropic.com/legal/consumer-terms. Задача не стоит так чтобы был выбор решать её или не решать. Тут гораздо более серьёзные проблемы, чем какие-то корнер кейсы. В плане следования регуляциям антропики идут в ногу с остальными.
Технически это у них вопрос политик, которые настраиваются в широких пределах. Например, кроме паспорта можно затребовать местный документ, подтверждающий законность нахождения в указанной локации. Такое используется скажем для прохождения сертификаций.
Оценки и рецензии на КП по-моему довольно специфические. Дочка как-то предложила "Страна хороших деточек (2013)". В плане менталитета я оцениваю нас не лучше других и рейтинг 2.7 на КП показался отдельной загадкой - может и правда заграница испортила нам вкусы и нравы?
Если кто не понял (не про вас конечно), что изменилось и из-за чего антропики собственно подсуетились.
Недавно были приняты поправки имени покойного сенатора, позволяющие (а в некоторых случаях даже требующие) вводить ограничения за помощь и сотрудничество в отношении третьих лиц и организаций, находящихся на любых территориях, а не только где эмбарго прописаны явным образом.
Вряд-ли кто-то читает комменты анонимов на Хабре, но столь прямолинейными заявлениями в рекламе своего продукта, вы как будто сами подводите его (а может и себя) под действие новых поправок. Надеюсь, что я не прав.
Немного наивно думать, что компания, которая решает вопросы обучения нейросетей, собирая данные со всего света, не может технически решить проблему определения локации пользователей.
Если вы не гик-параноик, то у вас на компьютере будет куча следов, в том числе и от других приложений и документов. Ещё больше сигналов добавляет характер самой информации, которую вы регулярно обрабатываете с помощью нейросетей. Особенно, когда вы работаете совместно с кем-то ещё.
В Интернете регулярно появляются новости в духе "нейросеть удалила 100500 гигабайт данных с моего диска". Но почему-то ни кто не пишет "нейросеть пересмотрела все данные, ни чего не удаляя". Хотя технически это одни и те же возможности. Случайные сканы вашего паспорта, счета за коммуналку, данные из профилей других браузеров, памяти параллельно запущенных процессов и кто знает что там ещё.
Такому бизнесу в разных вариациях много лет. Классика это прокси у домохозяек вообще в самих Штатах. Методы определения прокладок тоже постоянно совершенствуются.
Банить или не банить является вопросом не столько технологий, сколько бизнеса в рамках текущей конъюктуры. Политические нелегалы приносят свои хорошие деньги. Причём, чем сильнее санкции, тем они вынуждены тратить приносить ещё больше. Бизнес балансирует между рисками и размером выручки.
а дальше доступ только через госуслуги america.gov
Антропики, как и многие другие американские компании, теперь используют сервисы Persona для идентификации и аутентификации пользователей.
Затея с Госуслугами является локализацией той же идеи сделать аутентификацию централизованной и контролируемой в масштабах юрисдикции. Просто в Штатах такие вещи традиционно реализуют под видом бизнеса, а в РФ - госконтроля.
Claude code для этого теперь хватает auto mode и заклинания в промпте don't charge the code yet. А забить контекст в 1M токенов надо еще постараться. Он иногда сам переключает свой режим в planning и обратно. Я думаю, что фича полезная. Просто со стороны UX она видимо стала выглядеть как рудемент реализации, а не пользовательская ценность. О чём в общем-то и статья.
Классное замечание, я почему-то не думал об этом в таком ключе. Наверное потому, что в "Research & development" нет слова "планирование" и у меня оно ассоциировалось с первым.
В ходе ресерча агент предлагает гипотезы с различными допущениями. Например - использовать функцию из фреймворка. Крутой же план. Но понять, что это не галлюцинация и у такого решения нет каких-то подводных камней или конфликтов с текущей реализацией можно лишь выполнив код.
Результаты ресерча получаются чище, если во время написания спецификаций агент может создавать и запускать тестовые программы, вносить какие-то временные правки в код проекта, а потом откатывать назад. Создавать PR, чтобы пошарить промежуточные результаты с другими членами команды.
Получается, что разница между планированием и разработкой лежит где-то на уровне семантики - как мы ставим цели и оцениваем результаты. В плане механики отличий практически нет (разве что не деплоить в прод).
Про Gemini и Opus непонятно. Вы запускаете модели у себя или используете api вендоров, отдавая им свои данные?
Интересно, сколько стоит отсмотр 4000 PR в день? Порядок цифр в токенах и деньгах.
Материальное подкрепление безусловно влияет на мотивацию. Ее убивают цели и видение результатов, которые обычно вместе с ней стараются навязать (за что собственно платить).
Ошибки при обучении необходимы - на ошибках учатся. Это как топливо. Убираете право на ошибку и ни кто больше ни чему не учится. Все только делают умный вид.
Я после школы и курсов не мог разговаривать на английском, боясь сказать что-то не так или не то. Там за ошибку сразу ставили плохую оценку. А если промолчать, то ни чего не будет. Вот и учился молчать. Начал разговаривать только переехав заграницу. Оказалось, что ломаный английский это язык на котором говорит половина Европы, практически вся Индия, Австралия, Канада с таким же французским, а ещё - изрядная часть самих британцев. Стал просто разговаривать, как все.
В обучении классно работает, когда полученные знания можно тут же применять на практике. Обучение впрок работает плохо. Создавайте среду из которой можно добывать знания и где их можно применять.
Вместо того, чтобы сетовать на и так всем известные ограничения, физикам стоит открыть новый закон о передаче данных.
В комментариях на Хабре умудряются судить о качестве омлета, кто за всю свою жизнь его даже не видел. s/
Такой экскаватор нужно сперва собрать (харнесы, плагины, скиллы, hooks, mcp, lsp), проложить дороги (rules, AGENTS.md, semantic knowledge), научиться с ним управляться (промпт инжениринг, SDD, ревью), регулярно заправлять (subscriptions), постоянно наблюдать за показателями и обслуживать (agent evals, observability). Это все окупается, только когда у вас конвейер. Ну либо
велоэкскаваторостроение является вашим хобби.Разбираться в продукте (бизнесе, маркетинге, саппорте, процессах) и в коде - все ещё разные скиллы. Агенты помогают закрыть, условно, 20% незнания. Но если вы не смыслите в домене ни чего - они бесполезны. Product Engineers / Forward Deployed Engineers появляются лишь в специфичных ситуациях.
Много проблем возникает на уровне коммуникации между людьми, когда нужно искать не ответы, а компромиссы - договариваться. С помощью агентов можно быстро делать презентабельные презентации, но в целом от них толку мало.
Агенты удобны в кодинге, когда изменение легко локализовать и проверить. То есть, инженерная культура на проекте должна быть безупречной. Поэтому взрослые ребята теперь поставляют каждый день и нахваливают. У большинства же нет ни квалификации, ни денег для инвестиций в харнесы такого порядка. А без них агенты это стадо диких коней, которые норовят снести вам все на своём пути.
Древний закон кибернетики гласит:
Пасти стада агентов - дело не хитрое. В случае форсмажора пастух должен быть способен выдать решение на любую нештатную ситуацию. Но большую часть рабочего времени он сидит в тени уютного клена, наблюдая за своими барашками и развлекая себя игрой на дудочке, чтобы не помереть от тоски.
Работа в режиме meat proxy это не плохо - это рутина, как следствие улучшения процесов. Правда иногда приходится что-то мудрить.
Ночью у животных в свете фар видно лишь сверкающие глаза. Во всем остальном они эволюционно заточены ни чем не выделяться - иначе как охотиться или прятаться. Поэтому я зарекся ездить в темное время суток по трассе без особой необходимости.
Экспортные ограничения и связанные с ними обязательства - часть реальности https://www.anthropic.com/legal/consumer-terms. Задача не стоит так чтобы был выбор решать её или не решать. Тут гораздо более серьёзные проблемы, чем какие-то корнер кейсы. В плане следования регуляциям антропики идут в ногу с остальными.
Технически это у них вопрос политик, которые настраиваются в широких пределах. Например, кроме паспорта можно затребовать местный документ, подтверждающий законность нахождения в указанной локации. Такое используется скажем для прохождения сертификаций.
Оценки и рецензии на КП по-моему довольно специфические. Дочка как-то предложила "Страна хороших деточек (2013)". В плане менталитета я оцениваю нас не лучше других и рейтинг 2.7 на КП показался отдельной загадкой - может и правда заграница испортила нам вкусы и нравы?
Если кто не понял (не про вас конечно), что изменилось и из-за чего антропики собственно подсуетились.
Недавно были приняты поправки имени покойного сенатора, позволяющие (а в некоторых случаях даже требующие) вводить ограничения за помощь и сотрудничество в отношении третьих лиц и организаций, находящихся на любых территориях, а не только где эмбарго прописаны явным образом.
Вряд-ли кто-то читает комменты анонимов на Хабре, но столь прямолинейными заявлениями в рекламе своего продукта, вы как будто сами подводите его (а может и себя) под действие новых поправок. Надеюсь, что я не прав.
Немного наивно думать, что компания, которая решает вопросы обучения нейросетей, собирая данные со всего света, не может технически решить проблему определения локации пользователей.
Если вы не гик-параноик, то у вас на компьютере будет куча следов, в том числе и от других приложений и документов. Ещё больше сигналов добавляет характер самой информации, которую вы регулярно обрабатываете с помощью нейросетей. Особенно, когда вы работаете совместно с кем-то ещё.
В Интернете регулярно появляются новости в духе "нейросеть удалила 100500 гигабайт данных с моего диска". Но почему-то ни кто не пишет "нейросеть пересмотрела все данные, ни чего не удаляя". Хотя технически это одни и те же возможности. Случайные сканы вашего паспорта, счета за коммуналку, данные из профилей других браузеров, памяти параллельно запущенных процессов и кто знает что там ещё.
Такому бизнесу в разных вариациях много лет. Классика это прокси у домохозяек вообще в самих Штатах. Методы определения прокладок тоже постоянно совершенствуются.
Банить или не банить является вопросом не столько технологий, сколько бизнеса в рамках текущей конъюктуры. Политические нелегалы приносят свои хорошие деньги. Причём, чем сильнее санкции, тем они вынуждены
тратитьприносить ещё больше. Бизнес балансирует между рисками и размером выручки.Антропики, как и многие другие американские компании, теперь используют сервисы Persona для идентификации и аутентификации пользователей.
Затея с Госуслугами является локализацией той же идеи сделать аутентификацию централизованной и контролируемой в масштабах юрисдикции. Просто в Штатах такие вещи традиционно реализуют под видом бизнеса, а в РФ - госконтроля.
Может стробоскопический эффект?
Claude code для этого теперь хватает auto mode и заклинания в промпте don't charge the code yet. А забить контекст в 1M токенов надо еще постараться. Он иногда сам переключает свой режим в planning и обратно. Я думаю, что фича полезная. Просто со стороны UX она видимо стала выглядеть как рудемент реализации, а не пользовательская ценность. О чём в общем-то и статья.
Классное замечание, я почему-то не думал об этом в таком ключе. Наверное потому, что в "Research & development" нет слова "планирование" и у меня оно ассоциировалось с первым.
В ходе ресерча агент предлагает гипотезы с различными допущениями. Например - использовать функцию из фреймворка. Крутой же план. Но понять, что это не галлюцинация и у такого решения нет каких-то подводных камней или конфликтов с текущей реализацией можно лишь выполнив код.
Результаты ресерча получаются чище, если во время написания спецификаций агент может создавать и запускать тестовые программы, вносить какие-то временные правки в код проекта, а потом откатывать назад. Создавать PR, чтобы пошарить промежуточные результаты с другими членами команды.
Получается, что разница между планированием и разработкой лежит где-то на уровне семантики - как мы ставим цели и оцениваем результаты. В плане механики отличий практически нет (разве что не деплоить в прод).
Вот мы сейчас с вами смотрим на одно и тоже сообщение или на разные?