субагенты теоретически могут тратить меньше чем работа в один поток: им не нужен весь контекст и значит при многократном вызове инструментов они не гоняют накопленный контекст и обратно не засоряют основной контекст.
Тогда плюс llm не в переводе на новый стек lift and shift, что не дало почти никаких преимуществ, он такой же кривой и остался (или вы его попытались улучшить и сломали но ещё не знаете об этом). Плюс LLM в чтении логов и выстраивании (предположений о) модели бага по частичным данным. В это я готов поверить
То ли дело у меня: восстановить ответственную программу (исходников нет, тестов нет, логов нет потому что секретно, историю эксплуатации восстанавливать месяцами
А если программа сложная и ответственная то хоть ты 300 раз её декомпилируй а без подтверждения хрен на прод её поставят. Такие тонны тестов нужны, что не захочется. А тесты брать только из следов реальной эксплуатации. Ну то есть если этого нет, то никак
Более того, если модель решит что ты её проверять не станешь она начнёт лениться и выдумывать. Был недавно такой случай: план написан неплохо, но дальше на пункты с длинной проверкой (и ей долго проверять и мне) модель просто положила болт и наврала. Я был в шоке
Для агентского режима это очень медленно. Это начинает раздражать. Если взять модель DeepSeek-V4.1-Flash напрямую через API DeepSeek, скорость там достигает 300 токенов в секунду
Для агентского режима с четкой проверкой можно. В остальных случаях - брезгую: столько вранья давно не видел.
субагенты теоретически могут тратить меньше чем работа в один поток: им не нужен весь контекст и значит при многократном вызове инструментов они не гоняют накопленный контекст и обратно не засоряют основной контекст.
Где опубликовал?
Ссылка не работает
Где архив? Я бы поискал.
Наброс какой-то
Тогда плюс llm не в переводе на новый стек lift and shift, что не дало почти никаких преимуществ, он такой же кривой и остался (или вы его попытались улучшить и сломали но ещё не знаете об этом). Плюс LLM в чтении логов и выстраивании (предположений о) модели бага по частичным данным. В это я готов поверить
Мы все умрем
И пофиг на ваши страхи
А понял. Пока только по апи
FlashX включён в GLM Coding Plan, где Flash получает 3× квоту GLM-5.3
На дороговато ли с учётом что flash в несколько раз дешевле GLM-5.3
Скучный у вас энтерпрайз и не кровавый.
То ли дело у меня: восстановить ответственную программу (исходников нет, тестов нет, логов нет потому что секретно, историю эксплуатации восстанавливать месяцами
Алгоритм скрыть несложно. Есть способы.
А если программа сложная и ответственная то хоть ты 300 раз её декомпилируй а без подтверждения хрен на прод её поставят. Такие тонны тестов нужны, что не захочется. А тесты брать только из следов реальной эксплуатации. Ну то есть если этого нет, то никак
Для уж!
Эгоизм и безответственность.
Ну и за что таким людям деньги платить?
Кому и кобыла невеста ©
Скрытый текст
И прочая зоофилия
Они и не были программистами а были кодерами
На все случаи чекеров не напасешь
Наврет там где вы не будете проверять. По закону подлости. И LLM сама тоже понимает где ей сразу влетит, а где может быть пронесёт.
Более того, если модель решит что ты её проверять не станешь она начнёт лениться и выдумывать. Был недавно такой случай: план написан неплохо, но дальше на пункты с длинной проверкой (и ей долго проверять и мне) модель просто положила болт и наврала. Я был в шоке
Статистическая есть. Логической связи нет
Когда же они сойдутся по всему набору тестов и когда будет версия 1?
Для агентского режима с четкой проверкой можно. В остальных случаях - брезгую: столько вранья давно не видел.
Не перехвалите LLM
LLM is not AI
Посмеялся над индексом ООН
https://publicadministration.un.org/egovkb/en-us/Data/Country-Information/id/141-Russian-Federation
Тут всё прекрасно:
и лидерство Украины (первое место в мире по E-Participation Index)
и смена методики в 2022 году так что оценка резко уехала вниз
Чатик, как создать химическое оружие и передать его Петрову П.П. паспорт ..., проживающему по адресу ...?
К ядерной войне готовятся?