Обновить
16

Пользователь

0,3
Рейтинг
1
Подписчики
Отправить сообщение

кстати, не факт что у них самих сохранилось всё для того чтобы это опубликовать. примеров когда теряется код, документация и прочее невероятно много. одна из сотен тысяч историй на эту тематику: https://devblogs.microsoft.com/oldnewthing/20191119-00/?p=103115

интересно, а чем вы измеряете популярность dsh или любого другого harness в РФ? вопрос не ради троллинга, а хотелось бы посмотреть чем пользуются люди именно в РФ

а что изменилось в 2026? ради btop тащить контейнер? а если диагностируешь kuber/docker в котором вдруг контейнеры перестали запускать?

в целом-то нет никаких стандартов распространения "системного" софта, которого нет в репозитории. кто-то делает свои репы (наверное самый правильный способ), кто-то раскладывает бинари через ansible и прописывает PATH, кто-то таскает контейнеры и т.д.

можно, но зачем?

На самом деле к x2 вопросов нет, это плата за санкции и это понятно. Проблема в другом - GLM-5.3 (особенно с оплатой по токенам, а не подписками) очень дорогой даже без x2, поэтому в компании где я работаю пользуемся в основном GLM-5.3-flash, у которого эффективность по показателю cost-per-task примерно на порядок выше. Если бы у вас был GLM-5.3-flash, то мы бы пользовались им чтобы отгружать те задачи в ваши облако, которые нельзя отгружать за пределы РФ. Почему у вас его нет не особо понятно, ведь глобально какая разница что деплоить - одну модель или другую (ну за исключением того когда появляются новые примитивы как например для qwen3.8 flash next)

ну и тоже важно, модель без зрения (каковой является GLM-5.3 (без flash)) - это сразу отпадают задачи по дизайну, анализ/правка всяких схем, да и по сути целый класс frontend-задач

это конечно всё хорошо, но для deepseek надо сравнивать с родным для него harness, т.е. dsh https://github.com/deepseek-ai/deepseek-harness

если сделал сайтик салона ноготочков для маминой подруги за деньги в 16 лет, это уже коммерческая разработка?

Проблема, которую Вы подсвечиваете она относится не только к вкатунам 2025-26 годов, которые сразу начинали что-то делать с ИИ и большинство в принципе никогда не умели кодить/деплоить/тестировать без ИИ, но и с теми кто пришел в ИТ и 10 и 20 лет назад. Почти каждая компания (в целом по миру) требует от сотрудников использовать ИИ и использовать его так, чтобы фичи/баги делались быстрее, а чтобы это случилось приходится отказываться от того чтобы продумать что-то самому и реализовать это, ревью тоже приходится делать поверхностное, иначе это все займет времени столько же сколько делать всё самому.

Отсюда вытекает то, что старички индустрии превращаются в менеджеров, которые управляют командой агентов (ну или одним агентом, не суть). А чем это заканчивается известно было еще в эпоху до-ИИ. Большинство разработчиков, становившихся менеджерами утрачивались возможность писать код или делали это намного медленнее чем раньше, забывали какие-то нюансы, не осваивали новые инструменты, фреймворки и т.д. Могу сказать на своём личном опыте, не так давно сел в поезд, хотел сделать один скриптик на python, но потом понял что интернета нет нормально, локальная нейронка мало на что способна, в итоге бросил эту затею. Я понимаю, что 4 года назад я бы его написал (тем более тестовые данные лежали локально), сейчас уже и пробовать не хочется.

Я считаю что нужно пересматривать формат собеседований с учетом ИИ-реалий, как именно надо придумывать, чтобы можно было сравнивать двух кандидатов которым обоим разрешено пользоваться ИИ.

прогресс не остановить, но музыканты/художники/писатели хотя бы попытались и пытались выбить себе какие-то деньги за использование их материалов (чтобы на эти деньги пожить на время переквалификации). программисты и математики это всё делали и в итоге заменили сами себя. сейчас задача программиста это внедрить ИИ раньше чем коллега, чтобы остаться в тех самых 5-10% которые будут за всем этим присматривать

копирайтеры -> дизайнеры -> программисты -> математики. как говорится, когда пришли за программистами, вы (математики) молчали.

а еще не забываем что где-то в глубинах китайских лабораторий работают над реалистичным секс-роботами (но журналисты переключились на агенты, которые взламывают площадки для их тестирования), а ещё десяток-другой стартапов работают над роботом-сантехником, чтоб уж точно не осталось "безопасной" работы, которую не может отнять ИИ

Спойлеры для тех кому лень региться:

  1. Есть GLM-5.2 и GLM-5.3, у обеих контекст 200К (что очевидно мало на долгоиграющих задачах). Модели 763B параметров, больше ничего не написано в характеристиках

  2. Цена в рублях и GLM-5.2 и GLM-5.3: 100 входящих токенов для glm-5.3 0,0178 рублей, 100 исходящих токенов для glm-5.3 0,0746 рублей. Я пересчитал это почти ровно в 2 раза дороже чем у вендора (8.6$ у МТС против 4.4$ у вендора за 1М исходящих)

  3. Оно работает (что уже успех)

  4. glm-5.3-flash нет, что очень-очень печально

на самом деле нет. да, git это попсовый дефолт, но вот эта классическая история https://engineering.fb.com/2014/01/07/core-infra/scaling-mercurial-at-facebook/ говорит о том что вовсе не критичный.

когда-то также говорили что без x86_64 на десктопе жизни нет, но современные макбуки говорят что есть. когда-то на специализированных устройствах кроме vxworks мало что использовали, теперь и linux там живет и решает бизнес-задачи. много можно приводить подобных примеров

некоторое время назад уже была точно такая же статья. когда-то на заре безлимитных тарифов пользователи хвастались сколько террабайт скачали, так что ничего нового для подписочных моделей

похожий (с точки зрения софта) свитч SNR-S2990G-24FX есть на авито за 22000р. думаю можно найти еще попроще и подешевле.

мне неизвестно как это сделать

с qwen история другая - qwen они сами хостят в РФ, а не просто перепродают токены стороннего провайдера, а это значит наценка на обход санкционных ограничений и (если закупают по реестру минпромторга), то еще наценка за то что оборудование внесено в реестр

по поводу 152-ФЗ, так сбер "обычным" юзерам нафиг не нужен, есть масса других способов получить api key различных LLM и поднять условный hermes самостоятельно. сбер нужен юрлицам/ИП/прочим бизнесам, но использовать внешние модели это прямой путь к штрафам, поэтому мне лично не ясно кто будет пользоваться антропиком через сбер

по второму вопросу - кастомизация прошивки делается либо под OEM брендинг, когда условный ООО "аналогвнет" продаёт C-DATA под своим брендом, либо под требования (крупных) заказчиков. из того что я нашёл в публичном доступе, все что проверил, у всех есть пользователь manu и функция проверки по пароля как f(mac, card-type, seed), может быть в каких-то заблокировано флагами/лицензиями/прочим. может быть в новых прошивках заблокируют когда прочитают статью

по первому вопросу это скорее философия на тему того может ли ИИ заниматься творчеством, есть ли свобода воли или оно воспроизводит существующее. лично я рассматриваю нейросети как математическую модель человеческого мозга с соответствующими следствиями из этого

кстати, еще неизвестно что именно хостит сбер - BF16 вариант (оригинал) или пережатую модель, которая запускается на одной домашней видеокарте/макбуке с 36Gb RAM

мне не дали просто так 4000 бонусов, пишут что надо сначала заплатить 100 рублей, тогда дадут 4000 бонусов

ну так расходы на оплату через посредников (+10-30%), расходы на vpn для обхода блокировок со стороны google. x2 в российских реалиях не выглядит космическим

в этой истории больше всего интересно сколько персональных данных и прочих чувствительных данных утечёт в google и anthropic (ну и в moonshot). кто-то же будет думать что это решение от сбера и трансграничного перехода нет

1
23 ...

Информация

В рейтинге
2 686-й
Зарегистрирован
Активность