Pull to refresh
59

Пользователь

1
Rating
16
Subscribers
Send message

Про Gemini и Opus непонятно. Вы запускаете модели у себя или используете api вендоров, отдавая им свои данные?

Интересно, сколько стоит отсмотр 4000 PR в день? Порядок цифр в токенах и деньгах.

Материальное подкрепление безусловно влияет на мотивацию. Ее убивают цели и видение результатов, которые обычно вместе с ней стараются навязать (за что собственно платить).

Ошибки при обучении необходимы - на ошибках учатся. Это как топливо. Убираете право на ошибку и ни кто больше ни чему не учится. Все только делают умный вид.

Я после школы и курсов не мог разговаривать на английском, боясь сказать что-то не так или не то. Там за ошибку сразу ставили плохую оценку. А если промолчать, то ни чего не будет. Вот и учился молчать. Начал разговаривать только переехав заграницу. Оказалось, что ломаный английский это язык на котором говорит половина Европы, практически вся Индия, Австралия, Канада с таким же французским, а ещё - изрядная часть самих британцев. Стал просто разговаривать, как все.

В обучении классно работает, когда полученные знания можно тут же применять на практике. Обучение впрок работает плохо. Создавайте среду из которой можно добывать знания и где их можно применять.

Вместо того, чтобы сетовать на и так всем известные ограничения, физикам стоит открыть новый закон о передаче данных.

В комментариях на Хабре умудряются судить о качестве омлета, кто за всю свою жизнь его даже не видел. s/

Такой экскаватор нужно сперва собрать (харнесы, плагины, скиллы, hooks, mcp, lsp), проложить дороги (rules, AGENTS.md, semantic knowledge), научиться с ним управляться (промпт инжениринг, SDD, ревью), регулярно заправлять (subscriptions), постоянно наблюдать за показателями и обслуживать (agent evals, observability). Это все окупается, только когда у вас конвейер. Ну либо вело экскаваторостроение является вашим хобби.

Разбираться в продукте (бизнесе, маркетинге, саппорте, процессах) и в коде - все ещё разные скиллы. Агенты помогают закрыть, условно, 20% незнания. Но если вы не смыслите в домене ни чего - они бесполезны. Product Engineers / Forward Deployed Engineers появляются лишь в специфичных ситуациях.

Много проблем возникает на уровне коммуникации между людьми, когда нужно искать не ответы, а компромиссы - договариваться. С помощью агентов можно быстро делать презентабельные презентации, но в целом от них толку мало.

Агенты удобны в кодинге, когда изменение легко локализовать и проверить. То есть, инженерная культура на проекте должна быть безупречной. Поэтому взрослые ребята теперь поставляют каждый день и нахваливают. У большинства же нет ни квалификации, ни денег для инвестиций в харнесы такого порядка. А без них агенты это стадо диких коней, которые норовят снести вам все на своём пути.

Древний закон кибернетики гласит:

разнообразие управляющей системы должно быть не меньше разнообразия управляемого объекта или окружающей среды

Пасти стада агентов - дело не хитрое. В случае форсмажора пастух должен быть способен выдать решение на любую нештатную ситуацию. Но большую часть рабочего времени он сидит в тени уютного клена, наблюдая за своими барашками и развлекая себя игрой на дудочке, чтобы не помереть от тоски.

Работа в режиме meat proxy это не плохо - это рутина, как следствие улучшения процесов. Правда иногда приходится что-то мудрить.

Ночью у животных в свете фар видно лишь сверкающие глаза. Во всем остальном они эволюционно заточены ни чем не выделяться - иначе как охотиться или прятаться. Поэтому я зарекся ездить в темное время суток по трассе без особой необходимости.

Экспортные ограничения и связанные с ними обязательства - часть реальности https://www.anthropic.com/legal/consumer-terms. Задача не стоит так чтобы был выбор решать её или не решать. Тут гораздо более серьёзные проблемы, чем какие-то корнер кейсы. В плане следования регуляциям антропики идут в ногу с остальными.

Persona этого не проверяет.

Технически это у них вопрос политик, которые настраиваются в широких пределах. Например, кроме паспорта можно затребовать местный документ, подтверждающий законность нахождения в указанной локации. Такое используется скажем для прохождения сертификаций.

Оценки и рецензии на КП по-моему довольно специфические. Дочка как-то предложила "Страна хороших деточек (2013)". В плане менталитета я оцениваю нас не лучше других и рейтинг 2.7 на КП показался отдельной загадкой - может и правда заграница испортила нам вкусы и нравы?

Если кто не понял (не про вас конечно), что изменилось и из-за чего антропики собственно подсуетились.

Недавно были приняты поправки имени покойного сенатора, позволяющие (а в некоторых случаях даже требующие) вводить ограничения за помощь и сотрудничество в отношении третьих лиц и организаций, находящихся на любых территориях, а не только где эмбарго прописаны явным образом.

Вряд-ли кто-то читает комменты анонимов на Хабре, но столь прямолинейными заявлениями в рекламе своего продукта, вы как будто сами подводите его (а может и себя) под действие новых поправок. Надеюсь, что я не прав.

Немного наивно думать, что компания, которая решает вопросы обучения нейросетей, собирая данные со всего света, не может технически решить проблему определения локации пользователей.

Если вы не гик-параноик, то у вас на компьютере будет куча следов, в том числе и от других приложений и документов. Ещё больше сигналов добавляет характер самой информации, которую вы регулярно обрабатываете с помощью нейросетей. Особенно, когда вы работаете совместно с кем-то ещё.

В Интернете регулярно появляются новости в духе "нейросеть удалила 100500 гигабайт данных с моего диска". Но почему-то ни кто не пишет "нейросеть пересмотрела все данные, ни чего не удаляя". Хотя технически это одни и те же возможности. Случайные сканы вашего паспорта, счета за коммуналку, данные из профилей других браузеров, памяти параллельно запущенных процессов и кто знает что там ещё.

Такому бизнесу в разных вариациях много лет. Классика это прокси у домохозяек вообще в самих Штатах. Методы определения прокладок тоже постоянно совершенствуются.

Банить или не банить является вопросом не столько технологий, сколько бизнеса в рамках текущей конъюктуры. Политические нелегалы приносят свои хорошие деньги. Причём, чем сильнее санкции, тем они вынуждены тратить приносить ещё больше. Бизнес балансирует между рисками и размером выручки.

а дальше доступ только через госуслуги america.gov

Антропики, как и многие другие американские компании, теперь используют сервисы Persona для идентификации и аутентификации пользователей.

Затея с Госуслугами является локализацией той же идеи сделать аутентификацию централизованной и контролируемой в масштабах юрисдикции. Просто в Штатах такие вещи традиционно реализуют под видом бизнеса, а в РФ - госконтроля.

Claude code для этого теперь хватает auto mode и заклинания в промпте don't charge the code yet. А забить контекст в 1M токенов надо еще постараться. Он иногда сам переключает свой режим в planning и обратно. Я думаю, что фича полезная. Просто со стороны UX она видимо стала выглядеть как рудемент реализации, а не пользовательская ценность. О чём в общем-то и статья.

Это не режим планирования, а режим исследования

Классное замечание, я почему-то не думал об этом в таком ключе. Наверное потому, что в "Research & development" нет слова "планирование" и у меня оно ассоциировалось с первым.

В ходе ресерча агент предлагает гипотезы с различными допущениями. Например - использовать функцию из фреймворка. Крутой же план. Но понять, что это не галлюцинация и у такого решения нет каких-то подводных камней или конфликтов с текущей реализацией можно лишь выполнив код.

Результаты ресерча получаются чище, если во время написания спецификаций агент может создавать и запускать тестовые программы, вносить какие-то временные правки в код проекта, а потом откатывать назад. Создавать PR, чтобы пошарить промежуточные результаты с другими членами команды.

Получается, что разница между планированием и разработкой лежит где-то на уровне семантики - как мы ставим цели и оцениваем результаты. В плане механики отличий практически нет (разве что не деплоить в прод).

Вот мы сейчас с вами смотрим на одно и тоже сообщение или на разные?

1
23 ...

Information

Rating
2,139-th
Registered
Activity