Насчёт "дотаций" это спорный тейк, т.к. инференс при уже имеющейся инфраструктуре стОит по цене электроэнергии, то есть почти ничего не стоит в пересчёте на токен, а вычислительное оборудование промышленных стандартов работает по 20 более лет. Обучение новых моделей и закупка нового "железа" для них - вот что реально сжигает бюджеты.
Именно жёсткая конкуренция требует ввязываться в гонку моделей, тратя огромные деньги. Сам по себе инференс, по нынешним на него ценам, без учёта затрат на обучение и постоянный апгрейд железа - сверхприбыльная штука:)
Обычные покупатели инференса и сверхбогатые инвесторы в инфраструктуру с удовольствием готовы оплачивать весь этот кордебалет, так как всеновые моделикритично лучше старых, причём у всех производителей моделей.
Думаю, в ближайшие годы будет ситуация примерно как "iPhone vs Andriod phone", то есть, американская тройка лидеров + китайские нейросети, причём, у Китая будет примерно 80% мирового инференса, но 80% прибыли и инвестиций пойдут американцам. А потом производители железа, возможно, наконец-то начнут делать нормальные железки для локального запуска моделей среднего уровня (я надеюсь) :)
Чисто по ощущениям, кроме скорости, цены и расхода токенов, ещё есть и, скажем так, определённый стиль в диалоге и в подходах к решению задач. Лично мне нравится стиль работы claude, эта аккуратность и меткие доработки, на этот комфорт быстро "подсаживаешься" и при переходе на другие модели происходит наркоманская "ломка". Но и например qwen3.6-plus вполне себе хорошая рабочая лошадь, и как правильно написано в статье, она tool call и токены очень активно использует. Работа с Minimax субъективно происходит медленнее и больше итераций. Зайки z-ai/glm тоже не claude. Такое ощущение, что более слабые модели расходуют заметно больше итераций и токенов в итоге, чем более сильные, так они компенсируют свою слабость. В итоге у дешёвых моделей стоимость достижения результата не настолько драматически меньше, чем рассчитываешь, но всё равно дешевле. Но часто важнее скорость и точность прямо сразу, да и нервы у разработчиков не железные:)
Там конечно тоже рерайт копипасты, модель-то только что выпущена, и каких-то личных впечатлений ни у кого нет ещё. Я про саму систему публикаций, про то, что "ожидает модерации", и видимо будет ожидать вечно:) Ну а статья, да и фиг с ней, уже несколько раз про это написали :)
Подключение к платформе MAX для партнёров и её сервисам — чат-ботам, мини-приложениям, каналам — доступно для юрлиц и ИП, которые являются резидентами РФ MAX для разработчиков Но регистрироваться как ИП ради бесплатного бота в Максе, это как-то слишком уже, гг))
Людей раздражает сам MAX :) Насчёт мессенджеров. "Я планирую сделать тоже самое для TG, VK, OK, WA. " - для "обычных людей" лучше всего подходит бот в Телеграме, а остальные мессенджеры предполагают для подключения организационный геморрой и платные опции.
Насчёт вашего туториала - это просто демо-версия, для реального применения так делать нельзя.
Учёный в Средневековье.
Плюсы: ты учёный.
Минусы: на костре печёный.
(с)
Насчёт "дотаций" это спорный тейк, т.к. инференс при уже имеющейся инфраструктуре стОит по цене электроэнергии, то есть почти ничего не стоит в пересчёте на токен, а вычислительное оборудование промышленных стандартов работает по 20 более лет. Обучение новых моделей и закупка нового "железа" для них - вот что реально сжигает бюджеты.
Именно жёсткая конкуренция требует ввязываться в гонку моделей, тратя огромные деньги. Сам по себе инференс, по нынешним на него ценам, без учёта затрат на обучение и постоянный апгрейд железа - сверхприбыльная штука:)
Обычные покупатели инференса и сверхбогатые инвесторы в инфраструктуру с удовольствием готовы оплачивать весь этот кордебалет, так как все новые модели критично лучше старых, причём у всех производителей моделей.
Думаю, в ближайшие годы будет ситуация примерно как "iPhone vs Andriod phone", то есть, американская тройка лидеров + китайские нейросети, причём, у Китая будет примерно 80% мирового инференса, но 80% прибыли и инвестиций пойдут американцам.
А потом производители железа, возможно, наконец-то начнут делать нормальные железки для локального запуска моделей среднего уровня (я надеюсь) :)
Просто хорошая халявная модель, вот на неё все и переключились. При бесплатном периоде у Qwen 3.6 он вообще почти весь openrouter на себя перетянул:)
Так уже начали выкладывать.
На другом аккаунте статья на эту тему три дня висит на модерации.
А, теперь понятно:)
Если Вы про GLM , то сейчас там так:
https://openrouter.ai/z-ai/glm-5.1
Released Apr 7, 2026
202,752 context
$0,95/M input tokens
$3,15/M output tokens
Так может быть в любой офисной работе. Главное - это чтобы в целом устраивал руководитель и коллектив.
Чисто по ощущениям, кроме скорости, цены и расхода токенов, ещё есть и, скажем так, определённый стиль в диалоге и в подходах к решению задач. Лично мне нравится стиль работы claude, эта аккуратность и меткие доработки, на этот комфорт быстро "подсаживаешься" и при переходе на другие модели происходит наркоманская "ломка". Но и например qwen3.6-plus вполне себе хорошая рабочая лошадь, и как правильно написано в статье, она tool call и токены очень активно использует. Работа с Minimax субъективно происходит медленнее и больше итераций. Зайки z-ai/glm тоже не claude.
Такое ощущение, что более слабые модели расходуют заметно больше итераций и токенов в итоге, чем более сильные, так они компенсируют свою слабость. В итоге у дешёвых моделей стоимость достижения результата не настолько драматически меньше, чем рассчитываешь, но всё равно дешевле. Но часто важнее скорость и точность прямо сразу, да и нервы у разработчиков не железные:)
в наших законах это обязательно (регистрация по номеру телефона)
Это не баг, а фича:))
Перевод хороший, а оригинал - звучит так, как будто его написал сам Стейнбек:) Браво, Ребекка:)
Там конечно тоже рерайт копипасты, модель-то только что выпущена, и каких-то личных впечатлений ни у кого нет ещё.
Я про саму систему публикаций, про то, что "ожидает модерации", и видимо будет ожидать вечно:)
Ну а статья, да и фиг с ней, уже несколько раз про это написали :)
Я написал про эту модель первым... ну, или одним из первых... но теперь это, наверное, будет вечно жить в песочнице... :)
Квантовые белки
"Все эти ИИ-дата-центры, купленные на долг, живут примерно по три года. "
Ну погуглите, куда деваются "старые" серверы. Подсказываю: их используют для инференса.
Подключение к платформе MAX для партнёров и её сервисам — чат-ботам, мини-приложениям, каналам — доступно для юрлиц и ИП, которые являются резидентами РФMAX для разработчиков
Но регистрироваться как ИП ради бесплатного бота в Максе, это как-то слишком уже, гг))
«Чип, который поразит мир» пообещал показать на GTC 2026 глава Nvidia
19.02.2026
https://3dnews.ru/1137114/chip-kotoriy-porazit-mir-poobeshchal-pokazat-na-gtc-2026-glava-nvidia
Как из одной новости сделать 2 статьи))
"Помните клоунаду, котор"
Исправьте и вычитайте текст статьи, пожалуйста:)
Людей раздражает сам MAX :)
Насчёт мессенджеров. "Я планирую сделать тоже самое для TG, VK, OK, WA. " - для "обычных людей" лучше всего подходит бот в Телеграме, а остальные мессенджеры предполагают для подключения организационный геморрой и платные опции.
Насчёт вашего туториала - это просто демо-версия, для реального применения так делать нельзя.