Обновить
-1

Пользователь

0,2
Рейтинг
1
Подписчики
Отправить сообщение

Если компания мелкая, то будет вообще пофиг что вы там внутри openrouter дёргает в условный chatGPT или дипсик, если побольше и не хочется геморроя, то можно как взять что-то от хостяшегося у нас, так и самому захостить, оба варианта будут дешевле в разы. Сберовскую модель имеет смысл юзать только если хочется сертификат минцифры для каких-то специальных проектов.

И да, если вы попросите нормального агента, то он выдаст как альтернативу убрать проверку сертификата, но в первую очередь предложит ваше решение. Даёшь кодексу сертификат, и он сделает всё без проблем лол, вплоть до смок теста что оно и правда заводится корректно.

Как не открываю хром то вижу какую-то дичь с хабра в рекомендациях, то люди восхищаются бесполезным претрейном от Яндекса, то тут скрещивают две особо никому не нужные технологии и делают из этого пост...

Забавно, что это должно ваншотится за 3 минуты запросом в любого агента(codex, cc), включая гигачат 3.5 в условном OC, неужели кто-то кто настраивает работу нейронки не будет иметь к ней доступ?

Публиковать base модель без RL в 2026, чёт даже не знаю что сказать. Кому оно нужно, кто на основе этого будет делать что-то? У кого есть бюджет и данные на нормальный SFT+RL на это смотреть даже не будут, ибо нормальный RL по стоимости дороже претрейна в разы выходит и брать сомнительную базу не будут, у кого нет бюджета/данных - в 99% случаев небольшой тюн уже обученного квена выиграет с отрывом.

Не понимаю радости в комментах, "оно ещё живое"?)

Какой именно это гигачат? Ультра есть 3.5, если 3, есть вообще неделю назад выпущенный reasoning вариант. Это ж не условная астра про которую все знают и которая такая одна, ну указывайте нормально идентификатор модели, пожалуйста. Макс это что, второй который? Зачем его бенчить вообще, он неюзабельный был сразу на момент выхода...

Из серии "зачем использовать калькулятор", "давайте считать интегралы по часу вместо вольфрама" и так далее.

Разница в том что каждый чат в опенкоде это разные модели внутри опенкода. Orca/t3 code/zed позволяют переключаться между harness (обвязка и туллинг) агента, т.е. через одно приложение можно легко переключаться между OpenCode/codex/pi и так далее.

Затем, что это не harness, а штука поверх для управления несколькими harness одновременно? Вы же не путаете выбор разных моделей в OC с выбором разных агентов(сочетание модели + harness)?

Если цели использовать что-то кроме OC нет, то в целом плагинами OC можно довести до схожего состояния. Но если хочется одновременно использовать OpenCode + codex/Claude code/Pi etc, то помогает, наверное.

Из альтернатив тут хочется упомянуть t3 code, который менее заточен на IDE-like интерфейс и больше про работу в сразу нескольких репозитория + на сразу нескольких машинах. Опять же, это не harness, а оболочка где можно использовать разных агентов.

Подписки это просто способ саморекламы, потому что пользоваться по API это дорого, и без подписок обычные смертные пользоваться не будут. Сами компании субсидизируют свои coding plans, делая подписки которые на грани окупаемости, чтоб люди начали пользоваться их продуктами, и потом уже покупали по полной цене API со стороны enterprise.

Лимиты в кодинг планах довольно честные, если вы сравните с тем, сколько инференса вы смогли бы получить развернув модель на ноде HGX и платя за аренду. Вы получите меньшее, в худшем случае сранимое число токенов чем вы можете выжать из кодекса/GLM coding plan и так далее, при этом вам не нужно думать про аптайм, простой ГПУ и так далее. Поверх этого ещё и выжимать максимум и абузить чаты для agentic coding, имхо, это свинство.

В целом не удивлён таким ушлым людям, ещё ситуация с midjourney когда бесплатных пользователей именно из РФ забанили ибо они абузили создание подписок отлично показала менталитет. Потом не удивляйтесь, что страна в говне, когда каждый второй использует вот такой подход по жизни.

Боже, вам нельзя писать статьи если вы вообще не понимаете в теме и с такой уверенностью пишете бред. Я не просто строю приложения, но и писал свой harness, сам тюнил ллм, делал self evolution для промптов/скиллов, настраивал оркестрации сабагентов. Compaction это стандарт индустрии.

1) Это именно что фича, по другому нельзя сделать если вы работаете над какой-то функциональностью в репозитории, контекст забивается и с этим ничего не сделать. Сжатие контекста есть во всех agentic coding harness, без этого невозможно работать над большими проектами.

2) Специфически по кодексу, openAI единственные у кого сжатие контекста работает не так, у ребят сделан специальный эндпоинт в v1/responses через который они сохраняют сжатое векторное представление контекста, чего нет ни у каких других вендоров, они про это делали блог

3) Сабагенты, которых у вас нет, позволяют решать эту проблему, ибо часть с процессом exploration/review выносятся из контекста основного треда.

Rag подтягивание прошлых чатов - для этого агент может читать git history, если нужен журнал - кодекс может вести журнал тоже.

Ещё раз, не пишите бред и не вводите людей в заблуждение, а то потом люди это тестируют и думают что фиговая работа агентов это норма, в по факту они используют какие-то непонятные лайфхаки типо вот этого. Для нормальной работы агентов вам нужен compaction, у меня вот сейчас codex без проблем работает уже 12 часов подряд, именно за счёт всей работы команды разработчиков которые писали приложение. Даже если не делать супер-длинные запуски, на любой большой фиче в большом репо у вас не уместится решение задачи без одного-двух сжатий контекста, ваш подход не скейлится на реальные задачи разработки.

1) У кодекса есть auto compaction, которого вроде нет в ChatGPT

2) Дело не в промпте кодекса, дело в промпте самого ChatGPT, который никуда не девается и портит работу

3) Всё равно нет сабагентов

Я бы понял если бы это было бы для того чтоб получить pro версию gpt в режиме агента, ибо её нет в кодексе. А посыл "как поиграться с агентами, но с лимитами будто вы богатый" выглядит, как минимум, несерьёзно, рано или поздно лавку прикроют и в любом случае качества работы кодекса так не получается, какой-то самообман.

Да и в целом, инференс так-то не бесплатный, вот эти все лазейки лично у меня оставляют очень дурной привкус. Лимиты и так довольно большие, там идет огромная субсидизация по сравнению с просто API, поверх этого заниматься вот этой фигнёй всей...

Ну и жесть, это же не будет нормально адекватно работать. Кодекс делает десятки действий, спавнит субагентов, умеет напрямую запускать и тестировать код, там специальный промпт, специальный тул для редактирования кода...

"Возможно, стоит попробовать как раз ChatGPT?" - лучше опус или гемини, обе модели пишут текст для чтения лучше.

>Использование локальных моделей конечно возможно, но они также значительно слабее фронтир-моделей.

Если говорим про гигачат, то при чём тут фронтир модели?)

>Российские no LLM критичны там, где данные не должны покидать контур

В таких случаях обычно поднимают что-то под себя, тонна китайских open weight моделей есть. Снял себе в облаке карты и поднимаешь что-то нормальное. А то иначе данные и так покидают контур, просто на серваки Сбера))

Хз, у меня есть доступ к ультра и даже немного к закрытым версиям, но тестировать вообще не хочется, они в открытую заявляют что фокусируются на претрейне по сути, а без RL или ОЧЕНЬ качественного SFT на ОЧЕНЬ хороших агентных данных модель для кодинга бесполезна.

Инференс не копейки, они сейчас снимают серваки вообще везде, где только можно, даже у xAI арендовали, и им всё равно еле хватает.

1) У Сбера есть репо где-то на гитхабе с проксёй которая переводит их странный api в нормальной openAI формат.

2) Модельки не проходят никакого адекватного RL, поэтому агентности от нах не ждите особо.

Дали попробовать всем на 2 недели, а дальше только жёсткая тарификация без субсидий за инференс через подписки.

Если внимательно читать первоисточник, то написано, что модель будет возвращаться в планы подписок по ходу возможностей компании. У anthropic сильно не хватает мощностей, и они приотезируют продажу по api таким образом.

Доброе утро, уже не идёт, идёт в отдельный лимит programmatic usage, т.е. без субсидизации

Довольно смешной комментарий, вроде и совет неплохой, но вся аргументация мимо)

  • Claude Code, как и Codex, сильно выгоднее курсора. Это главный плюс, месячный лимит курсора тратиться за пару дней, кодекс на 20$ плане позволяет кодить где-то 3 часа в день спокойно, кодекс на 100$ плане позволяет делать современные сценарии использования агентов.

  • Что у CC, что у Codex есть а) плагин в vs code/cursor, b) отдельное приложение (у claude оно дико забагованное, но зато у кодекса оно прям топ). И да, в приложении можно в одном окне работать сразу в нескольких репо.

  • CLAUDE.md - антропики могут пойти в одно место за то, что не переходят на стандартный поддерживаемый везде AGENTS.md(хотя, учитывая как opus тупее gpt 5.5, может оно и к лучшему, ибо CLAUDE.md приходится держать сильно более многословным). Кстати, иерархия работает внутри проекта, никто не мешает класть AGENTS.md внутрь папок, они будут тоже читаться автоматически, скрин как выглядит настроенное репо:

    да, они автоматом читаются когда агент начинает работать в папке
    да, они автоматом читаются когда агент начинает работать в папке
  • Параллельность - мимо, параллельные агенты появились в курсоре полгода назад, можно только сказать спасибо автору статьи что он плохо это описал. Поддержка worktrees из коробки при запуске параллельных агентов в курсоре появилась чуть ли не первой. А ещё есть облачные агенты.

  • CLI вместо GUI - опять же, спасибо автору статьи за супер актуальный обзор, Cursor CLI существует уже месяцев девять)) Кстати, `claude -p` порезали, и теперь оно тратит отдельный маленький пул кредитов для автоматизации, и не идёт в лимиты подписки, удачи с автоматизацией)))

Информация

В рейтинге
2 634-й
Зарегистрирован
Активность