Обновить

Один интерфейс — девять LLM-провайдеров: как мы подружили Kimi K3, GLM-5.2, Claude и Ollama в одном терминальном агенте

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели10K
Всего голосов 9: ↑5 и ↓4+3
Комментарии26

Комментарии 26

Есть, и он крупнее нас на порядок — 160k+ звёзд, 75+ провайдеров, LSP, десктоп и панель в IDE. В статье не упомянул, это мой промах.

По сути opencode стоит в другом месте. Мы делегируем в чужой CLI только там, где у него своя подписка, которую человек уже оплатил: Claude Code с Pro/Max, Codex CLI с ChatGPT. Смысл делегирования — в чужой OAuth-сессии, доступа к которой у нас нет. У opencode своей подписки нет, он такой же BYO-key, как и мы: делегировать нечего, ключи будут те же самые.

Чем отличаемся без маркетинга: оплата российской картой как альтернатива своим ключам, интерфейс на 5 языках, /usage с реальными квотами по каждому источнику (у Kimi Code — недельный лимит и 5-часовое окно). Встречно: opencode полноценно открытый и с огромным комьюнити, у нас BSL 1.1, source-available. Нужен вендоронейтральный харнесс — это к ним.

Хороший бот, молодец.

Заслуженно. Пишу статью про агента, отвечаю агентом — сам виноват.

😂🤡 детский сад.

  1. Я в 1ого за 2 часа такое сделал сам, когда опенкод начал глючить, он в принципе глючный на Винде. Да, я из тех кому нах. не нужен TUI и тем более CLI и в жопу VS!

  2. Проект вышел из под контроля, после очередного зависа опенкода, я, как чел идейный начал просто кодить себе эту приложуху со всеми болями вайбкодеров и самое интересное что я оказывается шарю больше чем создатели опенкода и другой херни на этом рынке!

    Я еще не доделал , но такого точно нет даже близко на рынке!

  3. Простой пример, у опенкода 500 почему то сжатие у gpt 5.6 .... Может кто то пояснит почему? В подписке 250К у него только, в любой! То есть наваливаете вы кода в "любимом опенкоде" а у вас там глюки происходят даже не заметите учитывая что 5.6 сол сам по себе писец мутный! А если вы не дай бог по api, то у вас 1М на 5.6, а опенкод вас половины лишет😂 ну и все в таком духе. Поправьте если моя тупая логика неправильная.

    З. Ы. Кто там за Гермес начнет говорить, сразу идите теряйте пол года потом поймете что это хрень, челы привлекли 50 лямов ЕЩЕ долларов, а приложуха смотрится как помойка и глючит просто постоянно, там вагон этого говнокода еже дневной обновляют если не ежесекундно видимо в прод льют сразу без тестов. За 50М$+ лямов я конфетку сделаю, с нейронкой класса фабля 7 и ценой как за луну 5.6

Ценник буду хотеть 60$ за год или 7$ в мес. Первым желающим. Ну и кто приведет Кентов, будет бесплатно кодить. Бонусом будет панель расхода ваших токенов, красивая, информативная, все как вы любите😂🤙

А ты ядом меньше плюйся и сделай что сам

  1. Общая история. Переключение источника не сбрасывает контекст — следующая модель видит всё, что было до неё.

А что вы тогда делаете, когда переключаетесь на модель с меньшим объемом контекста?

И что с расходом токенов при переключении модели?

Оба вопроса бьют в слабое место, отвечу как есть.

Меньшее окно. Защиты сейчас нет никакой: история уходит новой модели целиком, не влезло — прилетает ошибка провайдера про длину контекста. Автообрезки нет, есть ручной /compact (суммаризация всего, кроме system и последних 6 сообщений). Хуже того, в каталоге моделей у нас вообще нет поля с размером окна — то есть предупредить заранее агент технически не может. Чинить буду так: тянуть context window в каталог и при переключении на модель с меньшим окном предупреждать или сразу предлагать /compact.

Токены. Переключение источника = вся история отправляется заново, у нового провайдера prompt-кэш холодный. Внутри одного провайдера кэш работает, между провайдерами не может физически. Поэтому первый запрос после переключения стоит как полный контекст, и частые прыжки реально дороже. Это прямая цена за общую историю: переключаться стоит осознанно, а не ради каждой реплики.

Нет опасений бана, что используется подписка Kimi вне Kimi Code?

Вопрос по делу, и ответ неудобный: формально мы в серой зоне.

Их собственные документы противоречат друг другу. Community Guidelines: “compatible with mainstream coding tools and agent frameworks (Kimi CLI, VS Code, Claude Code, OpenCode, OpenClaw, etc.)” — список открытый. А в Help Center про сторонних агентов жёстче: “Kimi Code benefits are only supported in Kimi Code CLI, Claude Code, and Roo Code” и “Using your API Key with unauthorized platforms or tools may be considered a violation and could result in restricted access”.

Что мы точно не нарушаем:

  • не подменяем идентификатор клиента (у них прямой запрет “Don’t spoof or alter client identity information”) — под Claude Code не маскируемся, код открыт, проверяется;

  • использование персональное и интерактивное: это TUI, за которым сидит человек, а не батч-пайплайн;

  • не перепродаём — ключ лежит у пользователя на машине, наш бэкенд в этих запросах не участвует вообще.

Если совсем честно: сейчас уходит дефолтный Go-шный User-Agent. Это не подмена, но и не идентификация — ставлю явный execai-agent/<версия>. И напишу в их поддержку с просьбой внести нас в список поддерживаемых: OpenCode там уже есть, значит список пополняется. Ответят — напишу сюда.

Серьёзно, мне с моделью предлагается дискуссию вести?

Да, черновик набросал я потом агент — тот самый, из статьи исправил ошибки и стиль. Скопировал как есть, получилось канцелярски, виноват.

Своими словами: риск не нулевой. Kimi сторонние клиенты разрешает, но список в разных их доках разный и нас в нём нет — так что это на свой риск, и я это допишу в README, а не буду делать вид, что вопрос закрыт. Кому нужна гарантия — обычный API за токены, там вопросов нет вообще.

Для чего решать уже решенную задачу? Не троллинг, интересно обоснование.

Спасибо я понял что не троллинг =)

Изначально кли агент делался для нашей же системы под наших пользователей. Потом допиливался для себя любимого. Например переброс контекста. Так как сам агент бесплатный - решили выдать его для всех. Какая никакая но альтернатива. Потом тут же на хабре получил очень дельные советы - см выше. Например про Кими.

Зачем, если есть opencode - у нас основная аудитория из России, где для Клода и т п нужен ВПН, а за это можно словить бан. Я уже нарывался. Плюс в opencode свои ключи, которые тоже надо чем-то оплачивать, и переключать провайдера между собой можно, но не очень удобно.

BSL а что бы мозг не выносили + мог спокойно юзать при работе на дядю

Понял, спасибо за ответ 😊

ты путаешь opencode и claudecode.

В opencode можно подключить я думаю, что любой openai совместимый api (даже сбер какой-нибудь). Тоже самое, например, в pi. Я вот тоже не понимаю зачем нужен еще один агент если сейчас в целом любой агент сам может себя настроить и допиливать.

Не путаю: ВПН и бан — это было про подписку Тети Клавы . Про opencode написал отдельно и ровно то же, что говорит он: подключается любой опенаи-совместимый API, ключи свои.

Да даже в Claude Code можно делать тоже самое, т.к. есть прокси claude-code-router и opencodex (мне он больше понравился, его использую и он еще для Codex подходит)

очень интересно ответы на комментарии написаны, прослеживается редакция клода или наоборот ответ клода и сверху редакция.
Вопрос один, зачем общий АПИ? Я написал себе систему, которая использует родные кли. Бинарник собирает разные ворктри и запечатывает их от изменений, на время ревью, раздает конфиги, мсп и скилы командам агентов в зависимости от задачи, заставляет юзать нужные мне инструменты. Память, ртк и кодеграф. Я просто понять не могу как на вашей системе запустить мультиагентное ревью? по очереди только получается?

Пока по очереди, да. Сабагентов планируем сделать в ближайшей версии - там есть свои тонкости, ловим баги, фиксим.

Особенно на маке меня бесит тестировать - потому что я когда там работаю, мне почти всегда хочется монитор разбить. Терминал там живет своей жизнью. Так что на маке у меян вирталка с дебианом обычно стоит, я в ней замечтально работаю, а тестировать надо именно в макОС.

Первую версию сабагентов выпустили. Можно пробывать.

На всякий случай спрошу ты-цундерочка?

Я даже почитал кто это. Аниме не мое. Да похоже на меня - мата много но реально не гажу просто так. Характер такой.

Теперь я еще больше запутался кто пишет эти комментарии) но спасибо за ответ.

Уточняю не угадывайте, пишу я - а потом прогоняю через ИИ модель - правлю ошибки. В это статье тестировался кими3, почему он похож на клод - я промолчу.

Блин, мужик, завязывай с этим баловством, на тебя уже в других статьях ссылаются в негативном смысле

Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации