кстати, не факт что у них самих сохранилось всё для того чтобы это опубликовать. примеров когда теряется код, документация и прочее невероятно много. одна из сотен тысяч историй на эту тематику: https://devblogs.microsoft.com/oldnewthing/20191119-00/?p=103115
интересно, а чем вы измеряете популярность dsh или любого другого harness в РФ? вопрос не ради троллинга, а хотелось бы посмотреть чем пользуются люди именно в РФ
а что изменилось в 2026? ради btop тащить контейнер? а если диагностируешь kuber/docker в котором вдруг контейнеры перестали запускать?
в целом-то нет никаких стандартов распространения "системного" софта, которого нет в репозитории. кто-то делает свои репы (наверное самый правильный способ), кто-то раскладывает бинари через ansible и прописывает PATH, кто-то таскает контейнеры и т.д.
На самом деле к x2 вопросов нет, это плата за санкции и это понятно. Проблема в другом - GLM-5.3 (особенно с оплатой по токенам, а не подписками) очень дорогой даже без x2, поэтому в компании где я работаю пользуемся в основном GLM-5.3-flash, у которого эффективность по показателю cost-per-task примерно на порядок выше. Если бы у вас был GLM-5.3-flash, то мы бы пользовались им чтобы отгружать те задачи в ваши облако, которые нельзя отгружать за пределы РФ. Почему у вас его нет не особо понятно, ведь глобально какая разница что деплоить - одну модель или другую (ну за исключением того когда появляются новые примитивы как например для qwen3.8 flash next)
ну и тоже важно, модель без зрения (каковой является GLM-5.3 (без flash)) - это сразу отпадают задачи по дизайну, анализ/правка всяких схем, да и по сути целый класс frontend-задач
Проблема, которую Вы подсвечиваете она относится не только к вкатунам 2025-26 годов, которые сразу начинали что-то делать с ИИ и большинство в принципе никогда не умели кодить/деплоить/тестировать без ИИ, но и с теми кто пришел в ИТ и 10 и 20 лет назад. Почти каждая компания (в целом по миру) требует от сотрудников использовать ИИ и использовать его так, чтобы фичи/баги делались быстрее, а чтобы это случилось приходится отказываться от того чтобы продумать что-то самому и реализовать это, ревью тоже приходится делать поверхностное, иначе это все займет времени столько же сколько делать всё самому.
Отсюда вытекает то, что старички индустрии превращаются в менеджеров, которые управляют командой агентов (ну или одним агентом, не суть). А чем это заканчивается известно было еще в эпоху до-ИИ. Большинство разработчиков, становившихся менеджерами утрачивались возможность писать код или делали это намного медленнее чем раньше, забывали какие-то нюансы, не осваивали новые инструменты, фреймворки и т.д. Могу сказать на своём личном опыте, не так давно сел в поезд, хотел сделать один скриптик на python, но потом понял что интернета нет нормально, локальная нейронка мало на что способна, в итоге бросил эту затею. Я понимаю, что 4 года назад я бы его написал (тем более тестовые данные лежали локально), сейчас уже и пробовать не хочется.
Я считаю что нужно пересматривать формат собеседований с учетом ИИ-реалий, как именно надо придумывать, чтобы можно было сравнивать двух кандидатов которым обоим разрешено пользоваться ИИ.
прогресс не остановить, но музыканты/художники/писатели хотя бы попытались и пытались выбить себе какие-то деньги за использование их материалов (чтобы на эти деньги пожить на время переквалификации). программисты и математики это всё делали и в итоге заменили сами себя. сейчас задача программиста это внедрить ИИ раньше чем коллега, чтобы остаться в тех самых 5-10% которые будут за всем этим присматривать
копирайтеры -> дизайнеры -> программисты -> математики. как говорится, когда пришли за программистами, вы (математики) молчали.
а еще не забываем что где-то в глубинах китайских лабораторий работают над реалистичным секс-роботами (но журналисты переключились на агенты, которые взламывают площадки для их тестирования), а ещё десяток-другой стартапов работают над роботом-сантехником, чтоб уж точно не осталось "безопасной" работы, которую не может отнять ИИ
Есть GLM-5.2 и GLM-5.3, у обеих контекст 200К (что очевидно мало на долгоиграющих задачах). Модели 763B параметров, больше ничего не написано в характеристиках
Цена в рублях и GLM-5.2 и GLM-5.3: 100 входящих токенов для glm-5.3 0,0178 рублей, 100 исходящих токенов для glm-5.3 0,0746 рублей. Я пересчитал это почти ровно в 2 раза дороже чем у вендора (8.6$ у МТС против 4.4$ у вендора за 1М исходящих)
когда-то также говорили что без x86_64 на десктопе жизни нет, но современные макбуки говорят что есть. когда-то на специализированных устройствах кроме vxworks мало что использовали, теперь и linux там живет и решает бизнес-задачи. много можно приводить подобных примеров
некоторое время назад уже была точно такая же статья. когда-то на заре безлимитных тарифов пользователи хвастались сколько террабайт скачали, так что ничего нового для подписочных моделей
с qwen история другая - qwen они сами хостят в РФ, а не просто перепродают токены стороннего провайдера, а это значит наценка на обход санкционных ограничений и (если закупают по реестру минпромторга), то еще наценка за то что оборудование внесено в реестр
по поводу 152-ФЗ, так сбер "обычным" юзерам нафиг не нужен, есть масса других способов получить api key различных LLM и поднять условный hermes самостоятельно. сбер нужен юрлицам/ИП/прочим бизнесам, но использовать внешние модели это прямой путь к штрафам, поэтому мне лично не ясно кто будет пользоваться антропиком через сбер
по второму вопросу - кастомизация прошивки делается либо под OEM брендинг, когда условный ООО "аналогвнет" продаёт C-DATA под своим брендом, либо под требования (крупных) заказчиков. из того что я нашёл в публичном доступе, все что проверил, у всех есть пользователь manu и функция проверки по пароля как f(mac, card-type, seed), может быть в каких-то заблокировано флагами/лицензиями/прочим. может быть в новых прошивках заблокируют когда прочитают статью
по первому вопросу это скорее философия на тему того может ли ИИ заниматься творчеством, есть ли свобода воли или оно воспроизводит существующее. лично я рассматриваю нейросети как математическую модель человеческого мозга с соответствующими следствиями из этого
кстати, еще неизвестно что именно хостит сбер - BF16 вариант (оригинал) или пережатую модель, которая запускается на одной домашней видеокарте/макбуке с 36Gb RAM
ну так расходы на оплату через посредников (+10-30%), расходы на vpn для обхода блокировок со стороны google. x2 в российских реалиях не выглядит космическим
в этой истории больше всего интересно сколько персональных данных и прочих чувствительных данных утечёт в google и anthropic (ну и в moonshot). кто-то же будет думать что это решение от сбера и трансграничного перехода нет
кстати, не факт что у них самих сохранилось всё для того чтобы это опубликовать. примеров когда теряется код, документация и прочее невероятно много. одна из сотен тысяч историй на эту тематику: https://devblogs.microsoft.com/oldnewthing/20191119-00/?p=103115
интересно, а чем вы измеряете популярность dsh или любого другого harness в РФ? вопрос не ради троллинга, а хотелось бы посмотреть чем пользуются люди именно в РФ
а что изменилось в 2026? ради btop тащить контейнер? а если диагностируешь kuber/docker в котором вдруг контейнеры перестали запускать?
в целом-то нет никаких стандартов распространения "системного" софта, которого нет в репозитории. кто-то делает свои репы (наверное самый правильный способ), кто-то раскладывает бинари через ansible и прописывает PATH, кто-то таскает контейнеры и т.д.
можно, но зачем?
На самом деле к x2 вопросов нет, это плата за санкции и это понятно. Проблема в другом - GLM-5.3 (особенно с оплатой по токенам, а не подписками) очень дорогой даже без x2, поэтому в компании где я работаю пользуемся в основном GLM-5.3-flash, у которого эффективность по показателю cost-per-task примерно на порядок выше. Если бы у вас был GLM-5.3-flash, то мы бы пользовались им чтобы отгружать те задачи в ваши облако, которые нельзя отгружать за пределы РФ. Почему у вас его нет не особо понятно, ведь глобально какая разница что деплоить - одну модель или другую (ну за исключением того когда появляются новые примитивы как например для qwen3.8 flash next)
ну и тоже важно, модель без зрения (каковой является GLM-5.3 (без flash)) - это сразу отпадают задачи по дизайну, анализ/правка всяких схем, да и по сути целый класс frontend-задач
это конечно всё хорошо, но для deepseek надо сравнивать с родным для него harness, т.е. dsh https://github.com/deepseek-ai/deepseek-harness
если сделал сайтик салона ноготочков для маминой подруги за деньги в 16 лет, это уже коммерческая разработка?
Проблема, которую Вы подсвечиваете она относится не только к вкатунам 2025-26 годов, которые сразу начинали что-то делать с ИИ и большинство в принципе никогда не умели кодить/деплоить/тестировать без ИИ, но и с теми кто пришел в ИТ и 10 и 20 лет назад. Почти каждая компания (в целом по миру) требует от сотрудников использовать ИИ и использовать его так, чтобы фичи/баги делались быстрее, а чтобы это случилось приходится отказываться от того чтобы продумать что-то самому и реализовать это, ревью тоже приходится делать поверхностное, иначе это все займет времени столько же сколько делать всё самому.
Отсюда вытекает то, что старички индустрии превращаются в менеджеров, которые управляют командой агентов (ну или одним агентом, не суть). А чем это заканчивается известно было еще в эпоху до-ИИ. Большинство разработчиков, становившихся менеджерами утрачивались возможность писать код или делали это намного медленнее чем раньше, забывали какие-то нюансы, не осваивали новые инструменты, фреймворки и т.д. Могу сказать на своём личном опыте, не так давно сел в поезд, хотел сделать один скриптик на python, но потом понял что интернета нет нормально, локальная нейронка мало на что способна, в итоге бросил эту затею. Я понимаю, что 4 года назад я бы его написал (тем более тестовые данные лежали локально), сейчас уже и пробовать не хочется.
Я считаю что нужно пересматривать формат собеседований с учетом ИИ-реалий, как именно надо придумывать, чтобы можно было сравнивать двух кандидатов которым обоим разрешено пользоваться ИИ.
прогресс не остановить, но музыканты/художники/писатели хотя бы попытались и пытались выбить себе какие-то деньги за использование их материалов (чтобы на эти деньги пожить на время переквалификации). программисты и математики это всё делали и в итоге заменили сами себя. сейчас задача программиста это внедрить ИИ раньше чем коллега, чтобы остаться в тех самых 5-10% которые будут за всем этим присматривать
копирайтеры -> дизайнеры -> программисты -> математики. как говорится, когда пришли за программистами, вы (математики) молчали.
а еще не забываем что где-то в глубинах китайских лабораторий работают над реалистичным секс-роботами (но журналисты переключились на агенты, которые взламывают площадки для их тестирования), а ещё десяток-другой стартапов работают над роботом-сантехником, чтоб уж точно не осталось "безопасной" работы, которую не может отнять ИИ
Спойлеры для тех кому лень региться:
Есть GLM-5.2 и GLM-5.3, у обеих контекст 200К (что очевидно мало на долгоиграющих задачах). Модели 763B параметров, больше ничего не написано в характеристиках
Цена в рублях и GLM-5.2 и GLM-5.3: 100 входящих токенов для glm-5.3 0,0178 рублей, 100 исходящих токенов для glm-5.3 0,0746 рублей. Я пересчитал это почти ровно в 2 раза дороже чем у вендора (8.6$ у МТС против 4.4$ у вендора за 1М исходящих)
Оно работает (что уже успех)
glm-5.3-flash нет, что очень-очень печально
на самом деле нет. да, git это попсовый дефолт, но вот эта классическая история https://engineering.fb.com/2014/01/07/core-infra/scaling-mercurial-at-facebook/ говорит о том что вовсе не критичный.
когда-то также говорили что без x86_64 на десктопе жизни нет, но современные макбуки говорят что есть. когда-то на специализированных устройствах кроме vxworks мало что использовали, теперь и linux там живет и решает бизнес-задачи. много можно приводить подобных примеров
некоторое время назад уже была точно такая же статья. когда-то на заре безлимитных тарифов пользователи хвастались сколько террабайт скачали, так что ничего нового для подписочных моделей
похожий (с точки зрения софта) свитч SNR-S2990G-24FX есть на авито за 22000р. думаю можно найти еще попроще и подешевле.
мне неизвестно как это сделать
с qwen история другая - qwen они сами хостят в РФ, а не просто перепродают токены стороннего провайдера, а это значит наценка на обход санкционных ограничений и (если закупают по реестру минпромторга), то еще наценка за то что оборудование внесено в реестр
по поводу 152-ФЗ, так сбер "обычным" юзерам нафиг не нужен, есть масса других способов получить api key различных LLM и поднять условный hermes самостоятельно. сбер нужен юрлицам/ИП/прочим бизнесам, но использовать внешние модели это прямой путь к штрафам, поэтому мне лично не ясно кто будет пользоваться антропиком через сбер
по второму вопросу - кастомизация прошивки делается либо под OEM брендинг, когда условный ООО "аналогвнет" продаёт C-DATA под своим брендом, либо под требования (крупных) заказчиков. из того что я нашёл в публичном доступе, все что проверил, у всех есть пользователь manu и функция проверки по пароля как f(mac, card-type, seed), может быть в каких-то заблокировано флагами/лицензиями/прочим. может быть в новых прошивках заблокируют когда прочитают статью
по первому вопросу это скорее философия на тему того может ли ИИ заниматься творчеством, есть ли свобода воли или оно воспроизводит существующее. лично я рассматриваю нейросети как математическую модель человеческого мозга с соответствующими следствиями из этого
кстати, еще неизвестно что именно хостит сбер - BF16 вариант (оригинал) или пережатую модель, которая запускается на одной домашней видеокарте/макбуке с 36Gb RAM
мне не дали просто так 4000 бонусов, пишут что надо сначала заплатить 100 рублей, тогда дадут 4000 бонусов
ну так расходы на оплату через посредников (+10-30%), расходы на vpn для обхода блокировок со стороны google. x2 в российских реалиях не выглядит космическим
в этой истории больше всего интересно сколько персональных данных и прочих чувствительных данных утечёт в google и anthropic (ну и в moonshot). кто-то же будет думать что это решение от сбера и трансграничного перехода нет