Есть GLM-5.2 и GLM-5.3, у обеих контекст 200К (что очевидно мало на долгоиграющих задачах). Модели 763B параметров, больше ничего не написано в характеристиках
Цена в рублях и GLM-5.2 и GLM-5.3: 100 входящих токенов для glm-5.3 0,0178 рублей, 100 исходящих токенов для glm-5.3 0,0746 рублей. Я пересчитал это почти ровно в 2 раза дороже чем у вендора (8.6$ у МТС против 4.4$ у вендора за 1М исходящих)
когда-то также говорили что без x86_64 на десктопе жизни нет, но современные макбуки говорят что есть. когда-то на специализированных устройствах кроме vxworks мало что использовали, теперь и linux там живет и решает бизнес-задачи. много можно приводить подобных примеров
некоторое время назад уже была точно такая же статья. когда-то на заре безлимитных тарифов пользователи хвастались сколько террабайт скачали, так что ничего нового для подписочных моделей
с qwen история другая - qwen они сами хостят в РФ, а не просто перепродают токены стороннего провайдера, а это значит наценка на обход санкционных ограничений и (если закупают по реестру минпромторга), то еще наценка за то что оборудование внесено в реестр
по поводу 152-ФЗ, так сбер "обычным" юзерам нафиг не нужен, есть масса других способов получить api key различных LLM и поднять условный hermes самостоятельно. сбер нужен юрлицам/ИП/прочим бизнесам, но использовать внешние модели это прямой путь к штрафам, поэтому мне лично не ясно кто будет пользоваться антропиком через сбер
по второму вопросу - кастомизация прошивки делается либо под OEM брендинг, когда условный ООО "аналогвнет" продаёт C-DATA под своим брендом, либо под требования (крупных) заказчиков. из того что я нашёл в публичном доступе, все что проверил, у всех есть пользователь manu и функция проверки по пароля как f(mac, card-type, seed), может быть в каких-то заблокировано флагами/лицензиями/прочим. может быть в новых прошивках заблокируют когда прочитают статью
по первому вопросу это скорее философия на тему того может ли ИИ заниматься творчеством, есть ли свобода воли или оно воспроизводит существующее. лично я рассматриваю нейросети как математическую модель человеческого мозга с соответствующими следствиями из этого
кстати, еще неизвестно что именно хостит сбер - BF16 вариант (оригинал) или пережатую модель, которая запускается на одной домашней видеокарте/макбуке с 36Gb RAM
ну так расходы на оплату через посредников (+10-30%), расходы на vpn для обхода блокировок со стороны google. x2 в российских реалиях не выглядит космическим
в этой истории больше всего интересно сколько персональных данных и прочих чувствительных данных утечёт в google и anthropic (ну и в moonshot). кто-то же будет думать что это решение от сбера и трансграничного перехода нет
у меня в максе забанили аккаунт через пару часов после регистрации, ни одного сообщения не написал даже. тех. поддержка отсутствует как класс, точнее есть какой-то чат с роботом, который не отвечает и через некоторое время просто удаляет сообщение. так что да, в современном цифровом мире блокировки аккаунтов это головная боль и что с ней делать не ясно, статья автора показывает что даже регуляторы не спасают (ну выпустил ЕС закон что должны указывать причину, но на дело это не сработало). и одно дело когда используешь его (аккаунт платформы) для развлечения, а другое дело когда для бизнеса/заработка денег или когда просто нет альтернативного варианта попасть в чат вуза/школы/детсада
если считать glm-5.2 и kimi k3 фронтирами или близки к ним, то на pay-as-you-go вряд ли поднимут, потому что цена там рыночная, это подтверждает наличие независимых провайдеров за примерно те же деньги на openrouter.ai. на счёт самого deepseek следим тут https://openrouter.ai/deepseek/deepseek-v4-flash-0731#providers и проверяем что будут делать сторонние провайдеры, когда сам deepseek "значительно" повысит цены. там кстати и сейчас есть провайдер deepinfra у которого цена $0.09/$0.18 против $0.14/$0.28 самого deepseek
с подписками, ситуация намного интереснее, тут будет зависеть от того сколько людей будут выедать им токенов в разы больше чем их стоимость по pay-as-you-go и будет ли это компенсироваться за счёт тех кто платит за подписку и слабо тратит токены. ну т.е. история 1-в-1 как с интернет-провайдингом и продаже абонентам 100мбит/с намного дешевле чем 100мбит/с стоит у "магистрального" оператора
но много ли от него толку? может он и способен писать спам-комментарии в соц.сетях, но например для кодинга он не особо полезен
честно говоря и deepseek v4-pro не то чтобы идёт рядом с топовыми моделями. если цену повысят до цены frontier-ов, то не ясно кто им будет пользоваться даже в Китае, у них есть модели куда лучше
да, когда-то для большинства свитчей (не только huawei) vxworks как базовая ОС, затем сталb кроме vxworks делать и на linux-е где всё управляется одним процессов, как в статье, потом потихоньку стали разделять компоненты внутри ОС (не только huawei, это было общее направление в индустрии)
жесткий real-time не нужен на свитчах, там софт это control и mgmt plane, если эти пакеты застрянут на пару микросекунд где-то, никто не умрёт, при хорошем дизайне сети, data трафик вообще не заходит в ОС, всё проходит внутри asic не попадая на cpu порт
По verilog есть некоторое количество работающих OSS-проектов, но нет тысяч дискуссий, комментариев, историй code review и исправления багов, что помогло бы ИИ научиться делать сразу работающие решения, также успешно как он справляется с созданием очередного дашборда на модном js-фреймворке. Ценная информация закопана в недрах компаний-разработчиков чипов - сам код, история коммитов, истории код-ревью, баг-трекер (что особенно полезно для обучения). Если пытаться заснуть это всё в контекст 1М, то очевидно его не хватит, RAG тоже не решит проблему. Единственный вариант на сегодняшний - это брать какой-нибудь GLM/Qwen (открытые веса) и дообучать по-настоящему на этих корпоративных данных. Интересно, в условном samsung этим кто-то занимается?
если выйти за пределы мира 25-40 летних ИТшников, то везде ситуация не такая как вы описываете. ну и про безвыходность да, талоны на бензин и фоточки с детского садика вы в ТГ не получите
Компании из США - может быть, но модели с открытыми весами хостят все подряд. Берёт GLM 5.2 / Kimi K3, смотрите на openrouter.ai сколько разных провайдеров её хостят и цены близки к ценам разработчиков. Сторонним провайдерам вообще нет смысла хостить её ниже стоимости, что говорит о том что разработчик продает токены по рыночной цене
Спойлеры для тех кому лень региться:
Есть GLM-5.2 и GLM-5.3, у обеих контекст 200К (что очевидно мало на долгоиграющих задачах). Модели 763B параметров, больше ничего не написано в характеристиках
Цена в рублях и GLM-5.2 и GLM-5.3: 100 входящих токенов для glm-5.3 0,0178 рублей, 100 исходящих токенов для glm-5.3 0,0746 рублей. Я пересчитал это почти ровно в 2 раза дороже чем у вендора (8.6$ у МТС против 4.4$ у вендора за 1М исходящих)
Оно работает (что уже успех)
glm-5.3-flash нет, что очень-очень печально
на самом деле нет. да, git это попсовый дефолт, но вот эта классическая история https://engineering.fb.com/2014/01/07/core-infra/scaling-mercurial-at-facebook/ говорит о том что вовсе не критичный.
когда-то также говорили что без x86_64 на десктопе жизни нет, но современные макбуки говорят что есть. когда-то на специализированных устройствах кроме vxworks мало что использовали, теперь и linux там живет и решает бизнес-задачи. много можно приводить подобных примеров
некоторое время назад уже была точно такая же статья. когда-то на заре безлимитных тарифов пользователи хвастались сколько террабайт скачали, так что ничего нового для подписочных моделей
похожий (с точки зрения софта) свитч SNR-S2990G-24FX есть на авито за 22000р. думаю можно найти еще попроще и подешевле.
мне неизвестно как это сделать
с qwen история другая - qwen они сами хостят в РФ, а не просто перепродают токены стороннего провайдера, а это значит наценка на обход санкционных ограничений и (если закупают по реестру минпромторга), то еще наценка за то что оборудование внесено в реестр
по поводу 152-ФЗ, так сбер "обычным" юзерам нафиг не нужен, есть масса других способов получить api key различных LLM и поднять условный hermes самостоятельно. сбер нужен юрлицам/ИП/прочим бизнесам, но использовать внешние модели это прямой путь к штрафам, поэтому мне лично не ясно кто будет пользоваться антропиком через сбер
по второму вопросу - кастомизация прошивки делается либо под OEM брендинг, когда условный ООО "аналогвнет" продаёт C-DATA под своим брендом, либо под требования (крупных) заказчиков. из того что я нашёл в публичном доступе, все что проверил, у всех есть пользователь manu и функция проверки по пароля как f(mac, card-type, seed), может быть в каких-то заблокировано флагами/лицензиями/прочим. может быть в новых прошивках заблокируют когда прочитают статью
по первому вопросу это скорее философия на тему того может ли ИИ заниматься творчеством, есть ли свобода воли или оно воспроизводит существующее. лично я рассматриваю нейросети как математическую модель человеческого мозга с соответствующими следствиями из этого
кстати, еще неизвестно что именно хостит сбер - BF16 вариант (оригинал) или пережатую модель, которая запускается на одной домашней видеокарте/макбуке с 36Gb RAM
мне не дали просто так 4000 бонусов, пишут что надо сначала заплатить 100 рублей, тогда дадут 4000 бонусов
ну так расходы на оплату через посредников (+10-30%), расходы на vpn для обхода блокировок со стороны google. x2 в российских реалиях не выглядит космическим
в этой истории больше всего интересно сколько персональных данных и прочих чувствительных данных утечёт в google и anthropic (ну и в moonshot). кто-то же будет думать что это решение от сбера и трансграничного перехода нет
я не поленился, зарегился и посмотрел что там
на выбор 3 агента и 5 LLM, ни одной своей. внутри контура только qwen3.6
у меня в максе забанили аккаунт через пару часов после регистрации, ни одного сообщения не написал даже. тех. поддержка отсутствует как класс, точнее есть какой-то чат с роботом, который не отвечает и через некоторое время просто удаляет сообщение. так что да, в современном цифровом мире блокировки аккаунтов это головная боль и что с ней делать не ясно, статья автора показывает что даже регуляторы не спасают (ну выпустил ЕС закон что должны указывать причину, но на дело это не сработало). и одно дело когда используешь его (аккаунт платформы) для развлечения, а другое дело когда для бизнеса/заработка денег или когда просто нет альтернативного варианта попасть в чат вуза/школы/детсада
если считать glm-5.2 и kimi k3 фронтирами или близки к ним, то на pay-as-you-go вряд ли поднимут, потому что цена там рыночная, это подтверждает наличие независимых провайдеров за примерно те же деньги на openrouter.ai. на счёт самого deepseek следим тут https://openrouter.ai/deepseek/deepseek-v4-flash-0731#providers и проверяем что будут делать сторонние провайдеры, когда сам deepseek "значительно" повысит цены. там кстати и сейчас есть провайдер deepinfra у которого цена $0.09/$0.18 против $0.14/$0.28 самого deepseek
с подписками, ситуация намного интереснее, тут будет зависеть от того сколько людей будут выедать им токенов в разы больше чем их стоимость по pay-as-you-go и будет ли это компенсироваться за счёт тех кто платит за подписку и слабо тратит токены. ну т.е. история 1-в-1 как с интернет-провайдингом и продаже абонентам 100мбит/с намного дешевле чем 100мбит/с стоит у "магистрального" оператора
но много ли от него толку? может он и способен писать спам-комментарии в соц.сетях, но например для кодинга он не особо полезен
честно говоря и deepseek v4-pro не то чтобы идёт рядом с топовыми моделями. если цену повысят до цены frontier-ов, то не ясно кто им будет пользоваться даже в Китае, у них есть модели куда лучше
да, когда-то для большинства свитчей (не только huawei) vxworks как базовая ОС, затем сталb кроме vxworks делать и на linux-е где всё управляется одним процессов, как в статье, потом потихоньку стали разделять компоненты внутри ОС (не только huawei, это было общее направление в индустрии)
жесткий real-time не нужен на свитчах, там софт это control и mgmt plane, если эти пакеты застрянут на пару микросекунд где-то, никто не умрёт, при хорошем дизайне сети, data трафик вообще не заходит в ОС, всё проходит внутри asic не попадая на cpu порт
По verilog есть некоторое количество работающих OSS-проектов, но нет тысяч дискуссий, комментариев, историй code review и исправления багов, что помогло бы ИИ научиться делать сразу работающие решения, также успешно как он справляется с созданием очередного дашборда на модном js-фреймворке. Ценная информация закопана в недрах компаний-разработчиков чипов - сам код, история коммитов, истории код-ревью, баг-трекер (что особенно полезно для обучения). Если пытаться заснуть это всё в контекст 1М, то очевидно его не хватит, RAG тоже не решит проблему. Единственный вариант на сегодняшний - это брать какой-нибудь GLM/Qwen (открытые веса) и дообучать по-настоящему на этих корпоративных данных. Интересно, в условном samsung этим кто-то занимается?
А что китайцы TrustAsia тоже отозвали? Скорее инструкция сверху ради продвижения сертификатов минцифры
если выйти за пределы мира 25-40 летних ИТшников, то везде ситуация не такая как вы описываете. ну и про безвыходность да, талоны на бензин и фоточки с детского садика вы в ТГ не получите
всё уже придумали до вас, как говорится
Компании из США - может быть, но модели с открытыми весами хостят все подряд. Берёт GLM 5.2 / Kimi K3, смотрите на openrouter.ai сколько разных провайдеров её хостят и цены близки к ценам разработчиков. Сторонним провайдерам вообще нет смысла хостить её ниже стоимости, что говорит о том что разработчик продает токены по рыночной цене