Вообще-то я как раз про то же самое. Что будет условный "ГосИИсуверенплатформ", надо готовиться к Чебурнету...
Я лишь не согласен с почему "врядли туда будут допускаться иностранные модели, даже не смотря на свободные веса". Отнюдь не из-за "враги узнают секреты".
Придется пользоваться все равно буржуйским старьем, только дообученным с приоритетом на "официально одобряемые ответы".
Вы же не считаете, что Алисы с Гигачатами "с нуля" собирались? Помню я прекрасно как всякие Шедеврумы на запрос "коренной житель" рисовали индейца (native american же). И сейчас на "разночтениях рус/англ" сплошь и рядом ловятся.
Но "большое количество компаний уже сейчас не готово отправлять свои данные в иностранные ИИ" - скорее лукавство. Нет никакой опасности на серверах в РФ запускать буржуйские модели. Каких только весов не выкладывают в открытый доступ.
Но законы требуют модели, правильно отвечающие на чувствительные вопросы. И это не про "враги узнают секреты".
И жутко интересно, что с остановками для запроса подтверждений пользователя. Ибо есть огромная разница между "разрешить творить вообще все, любую дичь", "запрашивать подтверждения" и "режим auto у Claude Code", который реально по пустякам не дергает, но на потенциально опасное запрашивает подтверждения.
Я предпочитаю, разумеется, по API серьезные модели гонять, даже бесплатные. 16GB и "сверхконфиденциально, нельзя в облако" слабо вяжется.
Но для интереса пробовал и на 4060Ti 16GB. И прелесть по сравнению с чатботами именно в получении готового результата, без кучи копипейста ошибок и кода в браузер и обратно.
Пример задачи, которую за несколько итераций именно локальная модель порешала. (nemotron, кажется, был - трудно настроить, чтобы инструменты качественно вызывались, зато mamba архитектура позволяет хороший контекст держать)
Напиши функцию на Python (numpy), которая рассчитывает уникальные углы дифракции для кубического кристалла по формуле , где .
Там именно что подводные камни есть, которые надо учесть. Но тут чатбот может и справится.
А это еще сложнее. Предметные области знать надо. И вряд ли с одного раза из чатика вы получите работающий код. Хотя сейчас не только локальные модели "выросли", может и получится уже.
Напиши на Python класс для работы с индексами Миллера в кубической кристаллической решетке.
Требования:
Метод для вычисления межплоскостного расстояния $d_{hkl}$ при заданном параметре решетки $a$.
Метод для проверки условия дифракции (правила погасания) для ГЦК (гранецентрированной кубической) решетки.
Функция должна принимать на вход индексы (h, k, l) и возвращать True/False для возможности дифракции.
Усложнение: Добавь расчет угла Брэгга (theta) для заданной длины волны (lambda) и порядка дифракции n=1.
Используй только стандартную библиотеку math, без numpy (проверим чистую алгоритмику).
Но при малейшей возможности, конечно, лучше API. А если не "функцию написать", а реально с проектом работать, то и подавно. Я бы даже при возможности выделить модели 96GB (а-ля Ryzen или Mac) не стал бы с локальными программировать. Только доверять им по Инету полазить и что-то найти, подобрать (тоже нужно хорошее понимание JSON и вообще структур для работы с инстурментами, MCP).
И еще пример, когда локальная модель необходима: что-то нафиговертил с роутером, нет интернета. Просишь локальную модель зайти по ssh и поправить. Какой-нибудь Mikrotik или даже OpenWRT задолбаюсь чинить из командной строки - конкретные команды не помню. А тут "под моим чутким руководством" - хорошая помощь.
Если еще будете продолжать эксперименты, обратите внимание на jinja шаблон и "от кого" берете квант.
К примеру, мне нравился unsloth для моделей "поговорить". Но как только нужна агентская работа (вызов тулзов) - сплошь и рядом он подкладывает какой-то стандратный шаблон, который именно что "пихает JSON в тело ответа вместо чтобы вызвать функцию".
И тут можно либо скачать оригинальный шаблон, либо слегка подправить существующий. Либо брать версию от кого-то еще.
Т.е. проблема может быть не в модели и не в кванте (хотя на мелких квантах типа Q3 действительно работа с инструментами страдает), а в обвязке.
В чем принципиальная разница с docx? Обычный ZIP c XML где лежит просто текст. В тегах, с мусором дополнительной информацией. Но поиск по слову в обычном notepad/vi работает.
"Не гейт, а шлюз", "не свич, а коммутатор", "не фаервол, а межсетевой экран", "не клава, а клавиатура".
Как борьбу за чистоту русского языка понять могу, хотя заставлять заменять "харнесс" на чисто русский аналог IMHO так себя затея. Но считать "неграмотных" , получающих "минус балл на сочинении", ИИшками точно не стоит. В других ветках наоборот. Поставил длинное тире: "шибко грамотный, точно ИИ".
"лицензировать" на что? На ремонт автомобилей, которые в эту страну производитель не поставляет?
Я реально не понимаю, за что вы топите: 1. Обучать мастеров делать то, на что нет спроса, периодически переобучать, держать под это склад запчастей и т.п. Просто на всякий случай, "вдруг кого-то занесет", 2. Опустить планку официального сервиса до "у Васяна", который может взяться за что угодно, что впервые видит, по ютубчику посмотрит че-как.
Я вот давеча пришел в хороший компьютерный сервис. Мне шикарно обслужили ноут, все почистили, термопасту заменили... Но сделать то же с модулем Intel Nuc и внешней видеокартой отказались, мол не специализируются на этом.
И именно такое поведение у меня вызывает доверие. В режиме "никогда не пробовал, но наверное умею" я и сам могу почти все.
можно подать на вход одновременно текст, картинку-референс и маску, и сеть поймет задачу комплексно: «возьми лицо с фото А, одень в костюм Б и поставь на фоне заката».
Вы уверены, что "официальный сервис" не имеет специализаций на определенных марках и работах?
Я к тому, что в другой стране может тупо не быть "официального сервиса" для вашей модели.
Для меня дико выглядит приехать на "официальный сервис Вольво", специализирующийся на грузовиках и требовать, чтобы чинили мою легковушку. Ну а че? Имеет же отношение к Вольво.
Если glm 5.3 flash через AP используетеI, сколько по цене выходит примерно в день средней работы (ну или в час)?
Заканчивается подписка Z.AI, которую год назад урвал за $36. Год горя не знал, но сейчас за сравнимые деньги многи других предложений. Выбираю...
По-моему, автор как раз честно поступил. Не сравнивал "это" даже с китайскими квенами. Только между собой.
Вообще-то я как раз про то же самое. Что будет условный "ГосИИсуверенплатформ", надо готовиться к Чебурнету...
Я лишь не согласен с почему "врядли туда будут допускаться иностранные модели, даже не смотря на свободные веса". Отнюдь не из-за "враги узнают секреты".
Придется пользоваться все равно буржуйским старьем, только дообученным с приоритетом на "официально одобряемые ответы".
Вы же не считаете, что Алисы с Гигачатами "с нуля" собирались? Помню я прекрасно как всякие Шедеврумы на запрос "коренной житель" рисовали индейца (native american же). И сейчас на "разночтениях рус/англ" сплошь и рядом ловятся.
Подготовка к Чебурнету - это правильно :(
Но "большое количество компаний уже сейчас не готово отправлять свои данные в иностранные ИИ" - скорее лукавство. Нет никакой опасности на серверах в РФ запускать буржуйские модели. Каких только весов не выкладывают в открытый доступ.
Но законы требуют модели, правильно отвечающие на чувствительные вопросы. И это не про "враги узнают секреты".
Я правильно понимаю, что для всех установили
https://api.deepseek.com(https://api.deepseek.com/anthropicдляClaude Code)?И жутко интересно, что с остановками для запроса подтверждений пользователя. Ибо есть огромная разница между "разрешить творить вообще все, любую дичь", "запрашивать подтверждения" и "режим auto у Claude Code", который реально по пустякам не дергает, но на потенциально опасное запрашивает подтверждения.
Если правда руки дойдут, вот еще кандидат, якобы под кодинго-агентские задачи заточен:
NeoHorse-1-9B — это очень свежая (сентябрь 2026) дообученная версия Qwen3.5-9B от команды TokenRhythm
Я предпочитаю, разумеется, по API серьезные модели гонять, даже бесплатные. 16GB и "сверхконфиденциально, нельзя в облако" слабо вяжется.
Но для интереса пробовал и на 4060Ti 16GB. И прелесть по сравнению с чатботами именно в получении готового результата, без кучи копипейста ошибок и кода в браузер и обратно.
Пример задачи, которую за несколько итераций именно локальная модель порешала. (nemotron, кажется, был - трудно настроить, чтобы инструменты качественно вызывались, зато mamba архитектура позволяет хороший контекст держать)
Там именно что подводные камни есть, которые надо учесть. Но тут чатбот может и справится.
А это еще сложнее. Предметные области знать надо. И вряд ли с одного раза из чатика вы получите работающий код. Хотя сейчас не только локальные модели "выросли", может и получится уже.
Но при малейшей возможности, конечно, лучше API. А если не "функцию написать", а реально с проектом работать, то и подавно. Я бы даже при возможности выделить модели 96GB (а-ля Ryzen или Mac) не стал бы с локальными программировать. Только доверять им по Инету полазить и что-то найти, подобрать (тоже нужно хорошее понимание JSON и вообще структур для работы с инстурментами, MCP).
И еще пример, когда локальная модель необходима: что-то нафиговертил с роутером, нет интернета. Просишь локальную модель зайти по ssh и поправить. Какой-нибудь Mikrotik или даже OpenWRT задолбаюсь чинить из командной строки - конкретные команды не помню. А тут "под моим чутким руководством" - хорошая помощь.
Если еще будете продолжать эксперименты, обратите внимание на jinja шаблон и "от кого" берете квант.
К примеру, мне нравился unsloth для моделей "поговорить". Но как только нужна агентская работа (вызов тулзов) - сплошь и рядом он подкладывает какой-то стандратный шаблон, который именно что "пихает JSON в тело ответа вместо чтобы вызвать функцию".
И тут можно либо скачать оригинальный шаблон, либо слегка подправить существующий. Либо брать версию от кого-то еще.
Т.е. проблема может быть не в модели и не в кванте (хотя на мелких квантах типа Q3 действительно работа с инструментами страдает), а в обвязке.
В чем принципиальная разница с docx? Обычный ZIP c XML где лежит просто текст. В тегах, с
мусоромдополнительной информацией. Но поиск по слову в обычном notepad/vi работает.Проблема именно отрендерить корректно...
Еще откровение :)
"Не гейт, а шлюз", "не свич, а коммутатор", "не фаервол, а межсетевой экран", "не клава, а клавиатура".
Как борьбу за чистоту русского языка понять могу, хотя заставлять заменять "харнесс" на чисто русский аналог IMHO так себя затея. Но считать "неграмотных" , получающих "минус балл на сочинении", ИИшками точно не стоит. В других ветках наоборот. Поставил длинное тире: "шибко грамотный, точно ИИ".
А как по-русски? Я даже не могу подобрать замену, чтобы сойти за человека.
Ну так приведите ссылку!
Я вот приводил https://www.mi.com/ru/support/service-centre/
Это агрегатор левых центров? Так покажите, кому верить!
Из спортивного интереса - у вас же к кисточке претензии были. На 180 градусов поверни - и проси такую же.
а) ворсинки жесткие
б) "натуральный", где они был слипшиеся и повисшие вас как раз эстетически не устроил
с) никто не мешает попросить учесть гравитацию небольшим плавным изгибом.
Вопрос: Если уж DGX Spark, то почему vLLM, а не родные NIM контейнеры, где все супероптимизировано именно для этого железа?
Именно! Гарантия - это расходы. Поэтому производитель и поставляет в некоторые страны отдельные кактегории своих товаров, а не всю линейку.
Действительно: дизель, бензин, электричка - какая разница, болячки одинаковые. Производитель-то тот же.
Ладно, заканчиваю. А то договоримся до "Боингом управлять умеешь? Вот тебе видео, иди рули Airbus."
Погуглил "сервис Xiaomi в Москве". Первый открывшийся мне сервис: Цены на услуги сервис-центра Xiaomi в Москве
Подскажете цену на замену ноги у робособаки?
Ну и заодно поясните, зачем на Xiaomi Россия фильтр по типам устройств
Hint: Нажмите "Телевизор" и проверьте, не уменьшится ли колдичество сервисов на карте.
Я охотно верю, что тащат все, что нипопадя. Но это не значит, что они это все берут.
"лицензировать" на что? На ремонт автомобилей, которые в эту страну производитель не поставляет?
Я реально не понимаю, за что вы топите:
1. Обучать мастеров делать то, на что нет спроса, периодически переобучать, держать под это склад запчастей и т.п. Просто на всякий случай, "вдруг кого-то занесет",
2. Опустить планку официального сервиса до "у Васяна", который может взяться за что угодно, что впервые видит, по ютубчику посмотрит че-как.
Я вот давеча пришел в хороший компьютерный сервис. Мне шикарно обслужили ноут, все почистили, термопасту заменили... Но сделать то же с модулем Intel Nuc и внешней видеокартой отказались, мол не специализируются на этом.
И именно такое поведение у меня вызывает доверие. В режиме "никогда не пробовал, но наверное умею" я и сам могу почти все.
Конечно, так и делается!
Вы немножко не дописали. "... на легковушках, которые в этой стране вообще производитель не продает, не поставляет".
"Пусть держит сервис, а вдруг мне понадобится".
Вы уверены, что "официальный сервис" не имеет специализаций на определенных марках и работах?
Я к тому, что в другой стране может тупо не быть "официального сервиса" для вашей модели.
Для меня дико выглядит приехать на "официальный сервис Вольво", специализирующийся на грузовиках и требовать, чтобы чинили мою легковушку. Ну а че? Имеет же отношение к Вольво.