Обновить
512K+

IT-инфраструктура *

Инфоцентры + базы данных + системы связи

583,77
Рейтинг
Сначала показывать
Порог рейтинга

Привет! Совсем скоро у нас выйдет подробная статья про критерии выбора железа для ИИ-нагрузок, в которой мы поговорим о GPU, системах хранения и, само собой, об охлаждении (без него вообще все сложно). Пока же —  небольшой тизер того, что вас ждет.

Всем интересующимся железом для ИИ мы обычно предлагаем пробежаться по небольшому чек-листу — в нем есть пять важных нюансов, с которыми стоит определиться на берегу. В нашем ПАК мы заранее все реализовали, но если вы подбираете оборудование самостоятельно, вам пригодится гайд для самопроверки.

  1. Уточняйте, как конкретно рассчитано энергопотребление. Советуем запросить у вендора не просто номинальный TDP, а именно пиковые параметры под реальной ИИ-нагрузкой, включая ресурсоемкие задачи обучения, — на этом отдельно остановимся в статье. В идеале узнать и схему резервирования PSU и уточнить, сохранит ли система при отказе одного PSU или ввода питания полную производительность.

  2. Узнайте, какой тепловой пакет на стойку, и что еще предусмотрено в ЦОДе. Скорее всего, вам ответят что-то вроде «Стандартная у нас стойка» — это повод уточнить, сколько кВт эта стандартная стойка держит и сколько в ней предполагается GPU-узлов.

  3. Устройство сетевой сегментации на уровне железа. Это тоже то, что будет полезно знать — в идеальном мире трафик от ML и бэкап-трафик должны идти по разным физическим сегментам. Иначе в один прекрасный день ночной бэкап просто “положит” обучение. К слову, об этом мы напишем отдельную статью.

  4. Уточните у производителя / поставщика, как будет продолжена работа с ИИ-приложениями, в случае отказа одного GPU-узла. Если в ответе вы услышите что-то про аварийное выключение со стратегией сохранения чекпоинтов, а также про автоматическую миграцию нагрузки — поздравляем, это правильный ответ.

  5. Как дела с мониторингом на уровне железа и ИИ-приложения. Да, да, не кубером и IPMI-консолью едиными. В observability-стеке обязательно должны быть GPU die temp, температура памяти, ошибки NVLink, power draw.

С этим Топ 5 уже можно идти и собирать хорошую рабочую инфру под ИИ-задачи в нужных вам масштабах. Подробнее про каждый из этих пунктов, экономику процесса (и когда она бывает ложной), избыточные и недостаточные параметры железа, отдельные сценарии инференса и многое другое — совсем скоро в нашем материале.

Теги:
+3
Комментарии0

22 → 187 сборок выделенных серверов в Москве ⚡️

Расширили линейку выделенных серверов в Москве с 22 до 187 конфигураций. Теперь подобрать сервер под нужную задачу можно еще точнее.

➖ Ходовые Intel Xeon E3, E5 и E-серии, Intel Core i7 и i9, AMD Ryzen 9 на DDR5. Под сайты, приложения, dev-стенды и 1С, где важна высокая частота ядер.

➖ Двухсокетные Intel Xeon Scalable Silver. Под виртуализацию, средние базы и все, где нужно много памяти и потоков.

➖ Мощные двух- и четырехсокетные Intel Xeon Gold 6230R, 6240 и 6330. Под тяжелые базы, большую аналитику и крупные проекты.

Посмотреть все конфигурации →

Теги:
+8
Комментарии0

Программа конференции GoCloud Tech 2026 уже на сайте

Зарегистрировались на конференцию для тех, кто двигает прогресс в эпоху искусственного интеллекта? Самое время выбрать свой трек: 

В треке «Инфраструктура»
Расскажем, как устроена облачная инфраструктура и как она меняется с ростом ИИ-нагрузок. Обсудим безопасность, отказоустойчивость и инженерные компромиссы при создании инфраструктурных сервисов.
Ждем: архитекторов, инженеров, DevOps и SRE, системных администраторов, технических лидеров и всех, кто проектирует, развивает или эксплуатирует облачную инфраструктуру и ИИ-платформы.

В треке «Разработка»
Обсудим, как меняется процесс разработки платформ с приходом ИИ. Обсудим безопасность, разработку собственных решений и границы возможностей ИИ-агентов.
Ждем: техлидов, backend-разработчиков, DevOps и SRE, AppSec-специалистов и всех, кто внедряет ИИ в разработку, строит внутренние платформы и отвечает за production-надежность.

В треке «Данные и ML»
Поговорим, как строить платформы данных и ML-системы, готовые к работе с ИИ. Разберем архитектуру Lakehouse, Data Governance, защиту чувствительных данных и инфраструктуру для высоконагруженного доступа к моделям.
Ждем: дата-, ML- и ИИ-инженеров, архитекторов, продуктовых менеджеров и всех, кто работает с корпоративными данными, LLM и ИИ-сервисами.

Смотрите программу на сайте. 

Теги:
0
Комментарии0

Нагрузочное тестирование подтвердило трехкратный запас производительности платформы SimpleOne

Группа компаний IBS провела нагрузочное тестирование ESM-платформы SimpleOne, развернутой в «Группе Лента». Результат — платформа устойчиво выдерживает нагрузку в 300% от целевой, а значит, готова к росту бизнеса заказчика без риска для стабильности сервиса.

Тестирование провели по трем причинам:

  1. Миграция SimpleOne с облачной инфраструктуры на локальный сервер

  2. Переход с Windows на Linux

  3. Проверка масштабируемости при росте числа пользователей и новых задач

Команда IBS проверила модуль ITSM, модуль управления ИТ-активами ITAM и доработки, сделанные специально под задачи «Ленты». Нагрузочный профиль собрали на основе статистики реальной эксплуатации — отобрали самые частые и «тяжелые» операции — и постепенно повышали нагрузку от 100% (текущая эксплуатация) до 300%. Время отклика системы при этом не выросло значительно.

«Для нас нагрузочное тестирование — это не разовая акция, а обязательный этап перед любыми значимыми изменениями в инфраструктуре. Получившийся результат дает нам уверенность, что мы можем спокойно развивать функциональность и подключать новых пользователей»

Светлана Никитина, руководитель центра компетенций тестирования Lenta tech.

«Мы протестировали решение SimpleOne, развернутое в компании, с запасом, кратно превышающим текущую нагрузку, и убедились, что оно выдерживает такой рост без потери качества работы»

Антон Бешенов, руководитель проекта IBS.

Подробнее на сайте

Теги:
-2
Комментарии1

Сайты в S3 теперь доступны на вашем домене

Технический адрес имя_бакета.website.twcstorage.ru больше не единственный вариант. В S3 появилась возможность разместить статический сайт и открыть его на собственном домене — например, blog.example.ru или docs.example.ru.

Работает так: вы собрали лендинг или портфолио — загружаете файлы в бакет, привязываете свой домен и отправляете ссылку в соцсети.

Что это дает:

1️⃣ Сайт работает на вашем домене, а не на техническом.

2️⃣ Не нужен отдельный веб-сервер, то есть обходитесь без аренды и настройки.

3️⃣ Контент раздается через CDN, и сайт грузится быстрее.

Как подключить: в настройках бакета выберите «Веб-сайт» → «Привязать собственный домен» → «Создать CDN-ресурс» → добавьте свой домен.

Подробнее о настройке → в доке

Разместить сайт на своем домене →

Теги:
+12
Комментарии0

Подключайтесь к вебинару о том, как внедрить ИИ-агентов в бизнес

В 12:00 (мск) мы начинаем вебинар. Вместе с партнерами из GlowByte и Data Sapience презентуем Фабрику агентов — готовый сервис для внедрения ИИ-агентов в бизнес, которое стабильно работает в облаке и on-premise. 

Что обсудим

✔ Что происходит с рынком искусственного интеллекта сейчас 

✔ Training vs Inference: где живет экономика ML-продукта 

✔ Как устроена фабрика агентов Kolmogorov․ai на инфраструктуре Selectel 

✔ Проведем демо платформы Kolmogorov․ai 

Подключайтесь к трансляции в VK и на YouTube.

Теги:
+6
Комментарии0

Как «Страна Девелопмент» перевела всю ИТ‑инфраструктуру в облако и ускорила проектирование

🏭Что за компания
«Страна Девелопмент» — федеральный девелопер с 17‑летним опытом, который строит жилую и коммерческую недвижимость в Тюмени, Екатеринбурге, Новосибирске, Санкт‑Петербурге, Москве и Подмосковье. Компания закрывает полный цикл — проектирование, строительные и подрядные работы, технический надзор, продажи, гарантийное обслуживание и управление недвижимостью. Параллельно с этим компания разрабатывает собственные отраслевые ИТ‑продукты.

⚡ Задача
Инфраструктура была разделена между собственными физическими серверами и облаком сторонней площадки, где не хватало ни запаса ресурсов, ни набора сервисов, ни нормальной поддержки контейнеризации. Отдельной проблемой были рабочие места проектировщиков: на видеокартах T4 крупные BIM‑модели приводили к «черному экрану», результаты работы терялись, схемы прорисовывались медленно. Бизнес требовал не менее 50 новых удаленных рабочих мест в месяц, но скорость проектирования падала из-за медленной коммуникации (сотрудники были разбросаны по разным городам) и нехватки компьютеров.

☁️ Что сделали
Сначала девелопер протестировал платформы Облако VMware и Cloud.ru Advanced, построил сетевой канал до дата‑центра и примерно за два месяца ушел с локальных серверов и от прежнего провайдера. Потом в виртуальный ЦОД переехали standalone‑приложения, 1С и внутренние продукты — со временем это выросло до 120 серверов, с резервным копированием и объектным хранилищем S3. Разработку вынесли на Cloud.ru Advanced: сервис контроля качества и сроков работы подрядчиков собрали на Cloud Container Engine (Kubernetes), пропускную способность обеспечили распределенным брокером сообщений Kafka, туда же перенесли корпоративный портал и подключили защиту от DDoS. После развернули VDI с GPU под проектировщиков: 18‑ядерные процессоры от 3 ГГц, карты A40, высокочастотная DDR4 и сертифицированные инженеры VMware на стороне провайдера обеспечили удобство работы и высокую скорость миграции. Первые 200 рабочих мест из 600 запланированных настроили уже за первые две недели, при плане рассчитанном на два месяца.

🦾 Что получили в итоге
Вся ИТ‑инфраструктура девелопера теперь работает в облаке Cloud.ru. Оно держит растущую нагрузку и остается отказоустойчивым, SLA и обслуживание оборудования перешли к провайдеру: внутренняя команда больше не тратит время на железо и обновления. Cloud.ru Advanced стал платформой для новых продуктов компании, часть из которых регистрируется в реестре отечественного ПО Минцифры. Сейчас девелопер арендует 850 виртуальных рабочих мест с A40: архитекторы со всех уголков страны работают в единой инфраструктуре и подключаются к моделям прямо на Revit‑серверах, не выкачивая их на локальные машины. Производительность специалистов выросла на 30%, что дает до десяти дополнительных объектов в проектировании за год, а гибкая тарификация снизила расходы на инфраструктуру. Дальше в планах — Managed Arenadata DB для задач big data, пилот платформы Cloud.ru Evolution и новые типы виртуальных рабочих мест, в том числе сессионные.

Читайте подробнее на сайте.

Теги:
0
Комментарии0

В Telegram появился WEB‑прокси: как мессенджер учится притворяться обычным сайтом и чем это отличается от SOCKS5 и MTProto

В конце августа пользователи обратили внимание, что в Telegram появился новый тип подключения — Web-прокси. Одновременно разработчики выложили открытый репозиторий telegramdesktop/tproxy-server.

Что это за зверь и почему классические прокси проигрывают цензуре?

Любой прокси-сервер — это посредник между вашим устройством и конечным сервисом. Разница в том, как именно этот посредник передает ваши данные и насколько он заметен для систем DPI (глубокого анализа пакетов):

  • Прямое подключение (без посредников): Пакеты летят напрямую в подсети Telegram. Провайдер сразу видит целевые IP-адреса мессенджера или характерные сигнатуры и обрубает соединение.

  • Обычный прокси (SOCKS5): Протокол передает данные и рукопожатие открытым текстом. DPI давно умеет распознавать сигнатуры протокола, в текущих реалиях прокси работают плохо.

  • MTProto с Fake-TLS: Притворяется HTTPS-сессией к чужому, как правило популярному ресурсу (google.com). Но у прокси нет настоящего SSL-сертификата и ключей от чужого домена. Цензоры научились слать на подозрительный сервер проверочные запросы, в случае получения нехарактерного для указанного домена ответа, соединение банится.

  • WEB-прокси: Telegram заворачивает трафик в стандартные веб-протоколы (HTTPS / WebSocket) через встроенный движок браузера. Запрос идет на обычный домен с настоящим SSL-сертификатом от Let's Encrypt. Снаружи на этом адресе висит реальный сайт (даже обычный одностраничник), поэтому любая автоматическая проверка видит обычный веб-серфинг.

В чем главная техническая хитрость?

Telegram не стал изобретать собственный велосипед для маскировки TLS-отпечатков, а просто использует встроенный системный движок браузера.

Для DPI провайдера такое соединение неотличимо от ситуации, когда пользователь просто открыл вкладку в браузере и смотрит страничку.

Как устроен tproxy-server

Что мы видим в репозитории telegramdesktop/tproxy-server:

  1. Сервер слушает только веб-порты (80 и 443). Все служебные порты остаются внутри локального сетевого интерфейса.

  2. Обязательный сайт-прикрытие. Разработчики специально не добавили в репозиторий готовый шаблон сайта, чтобы исключить слепое копирование (защита от дурака). В документации так и сказано — если тысячи операторов поставят один и тот же дефолтный лендинг, по нему создадут сигнатуру. Сервер требует настроить проксирование на любой реальный сайт (блог на WordPress, документацию, портфолио или страницу на React/Node.js).

  3. Разделение потоков. Когда на порт 443 приходит проверяющий, робот или случайный посетитель — сервер возвращает обычные HTML/CSS-страницы. Но если по специальному пути приходит клиент Telegram с валидным секретным ключом, соединение проксируется на внутренний демон mtproto-proxy.

Что нужно, чтобы поднять свой WEB-прокси?

Для самостоятельного развертывания понадобится собственный VPS за пределами зон фильтрации (подойдет любой недорогой виртуальный сервер, главное, чтобы он не был заблокирован), доменное имя (любой недорогой домен в свободной зоне (.xyz, .site, .top или .com/.net), SSL-сертификат (выпускается автоматически через Let's Encrypt или ZeroSSL).

Также нужно будет оформить сайт-фасад (сделать на домене статичную веб-страницу, чтобы сайт выглядел как сайт и не вызывал подозрений) и понадобится также секретный ключ, который Генерируется стандартной утилитой openssl rand -hex 16.

Главный плюс такого подхода заключается в том, что если домен попадет под блокировку, ничего не придется перенастраивать с нуля. Достаточно будет зарегистрировать новый домен за, направить DNS-запись на тот же IP-адрес и перевыпустить сертификат. И WEB-прокси снова работают.

Теги:
+8
Комментарии4

Облачные провайдеры поднимают российский ИТ-рынок

Аналитики считают, что российский ИТ-рынок вырастет в 2026 году всего на 4%, а к двузначному росту вернётся не раньше 2028 года. Основные причины — замедление экономики и смещение фокуса с цифровизации к поддержке базовых процессов. Мы бы ещё прибавили значительный рост цен на комплектующие и их дефицит.

Кто тянет российский рынок? Облачные сервисы — хотя в 2026 году темп роста замедлится, но все равно составит 20%. А сервис аренды GPU-мощностей — на 36% и будет столько же прибавлять до 2028 года. Полагаем, что главным драйвером развития рынка остаётся ИИ: компании разрабатывают собственные модели, локально запускают доступные мировые решения. И аналитики считают, что рост проходил бы ещё быстрее, если бы не дефицит площадок под дата-центры, из-за которого замораживаются проекты постройки новых ЦОДов. RUVDS уже писала, что повышение аренды земли под вычислительные комплексы в десятки раз — не лучший стимул для развития отрасли.

Возвращаясь к дефициту компонентов, он приводит к интересным последствиям — аналитики OCS сообщили, что впервые поставки серверных SSD превысили продажи жестких дисков для серверов. Хотя твердотельные накопители дорожают быстрее, в условиях ограниченных ресурсов компании выбирают более эффективное решение. Производству жёстких же дисков мешает дефицит комплектующих — производители начинают уделять внимание самым топовым моделям, но они стоят дороже и у клиента уже возникают вопросы — не целесообразнее ли купить HDD. Естественно, базовые преимущества SSD (скорость) и жёстких дисков (низкая цена хранения) остаются, и в мировом масштабе основная информация хранится именно на HDD.

В итоге облачные провайдеры остаются оптимальным решением: они за пользователя решают проблему с дефицитом и удорожанием комплектующих и дают ему возможность без капитальных инвестиций проверить, серверы на каких комплектующих нужны для бизнеса.

Теги:
+24
Комментарии0

TLS без секретов

Добавили в маркетплейс дополнений для Kubernetes аддон cert-manager CSI Driver — он выдает TLS-сертификаты подам напрямую, без Certificate и Secret.

Классическая схема с Secret имеет слабое место: секреты лежат в etcd и доступны любому с правами на namespace. CSI Driver убирает посредника:

1️⃣ У каждого пода своя пара ключей — приватный ключ генерируется прямо на ноде и не передается по сети.

2️⃣ Ключ удаляется вместе с подом — не остается зависших секретов, которые нужно чистить

3️⃣ Сертификаты обновляются автоматически — без ручных перевыпусков и просроченных TLS

Пригодится, когда сервисы внутри кластера подтверждают подлинность друг друга по сертификатам. После настройки каждый под автоматически получает свой сертификат и приватный ключ при запуске.

Как установить: откройте кластер → Дополнения → cert-manager CSI Driver. Понадобится cert-manager — он тоже есть в маркетплейсе. 

Подключить аддон к кластеру →

Теги:
+20
Комментарии0

Как частное облако помогло Okko выдержать наплыв зрителей в периоды крупных чемпионатов

🏭 Что за компания
Okko — один из крупнейших российских онлайн-кинотеатров. Фильмы, сериалы и в особенности спортивные события привлекают миллионы пользователей. Сервису было критически важно поддерживать бесперебойную работу платформы даже в периоды максимальной нагрузки.

⚡ Задача
Okko располагал собственной инфраструктурой в Москве и Санкт-Петербурге, необходимо было связать все воедино, обеспечить резервной площадкой и убедиться, что платформа будет работать стабильно даже при взрывном росте аудитории. 

☁️ Что сделали
Используя платформу Cloud.ru Evolution Stack развернули частное облако на 294 хостах, реализовали новую сетевую архитектуру и георезервирование. В качестве резервной площадки выступило публичное облако Cloud.ru. Единство кодовой базы публичного и частного облака обеспечило бесшовное масштабирование и стабильную работу онлайн-кинотеатра при высоких нагрузках. 

🦾 Что получили в итоге
Скорость SDN-компонентов достигла 240 Гбит/с, обеспечены необходимые показатели пропускной способности сети и количества одновременно поддерживаемых пользователей. Собственная инфраструктура кинотеатра показала свою устойчивость в период Олимпийских игр. А во время финала Лиги чемпионов нагрузку подхватило публичное облако, что обеспечило доступ к трансляции для 4,5 млн зрителей. Инфраструктура готова к еще большему масштабированию без изменения архитектуры. 

Все подробности кейса читайте на сайте.

Теги:
+3
Комментарии0

Incident Management: почему компании живут от аварии до аварии

Системы без аварий не существует. Это не пессимизм — это физика распределённых систем. Вопрос не в том, случится ли инцидент, а в том, будет ли команда к нему готова и станет ли система после него лучше или просто вернётся в исходное состояние до следующего раза.

В новом выпуске «В SREду на кухне» вместе с Максимом Бурцевым, руководителем отдела мониторинга в e-commerce, разобрали, что отличает команду, которая учится на авариях, от той, что просто их переживает.

Что на повестке

Почему большинство инцидентов случаются сразу после релиза — и при чём тут овертаймы и дежурства. Как работать с Root Cause вместо того, чтобы латать одни и те же дыры по кругу. Кто должен управлять инцидентом в моменте и какие три вопроса нужно задать сразу после аварии. Сколько на самом деле стоит инцидент — и стоит ли рассказывать об этом пользователям. Отдельно — про AI: добавит ли вайб-кодинг новых аварий и может ли AI помочь ими управлять. В Авито уже попробовали — рассказали, что получилось.

🔵 VK Видео 
📺 YouTube
📌 RuTube
Ⓜ️ Mave

Посмотрите этот выпуск, если ваша команда разбирает инциденты по принципу «нашли виноватого, закрыли тикет».

Теги:
+31
Комментарии0

SimpleOne ITAM 1.8.0: инвентаризация без Excel и ручного пересчета

Что меняется для ИТ и финансов:

Инвентаризация со сканером штрихкодов

К задачам инвентаризации склада теперь можно подключать внешний сканер. Он считывает штрихкод с инвентарным номером быстрее камеры телефона, сразу сверяет данные со списком активов и автоматически заполняет ведомость.

Инвентаризация по фактическому расположению

Появился новый тип задач — по локации: офис, этаж, кабинет.
Так можно пересчитывать оборудование там, где оно реально используется, даже если по учёту оно «разбросано» по разным складам. Удобно для компаний с распределённой сетью офисов: проверяете конкретное подразделение, не трогая весь склад.

Автоматический расчёт совокупных затрат

SimpleOne ITAM теперь автоматически считает полную стоимость владения активом: складывает все затраты по активу, даже если они в разных валютах, и приводит их к единой валюте по актуальному курсу.

Подробнее о SimpleOne ITAM
Техническая документация

Теги:
+3
Комментарии0

Ближайшие события

Третий день Летнего ТехФеста — в нашем новом влоге

Мы заглянули в офис Okko, чтобы посмотреть, как устроена AI-кухня. Было технично, честно и очень вдохновляюще.

Смотри видео, чтобы погрузиться в событие.

Ещё больше о мероприятиях — в нашем TG-канале.

Теги:
+3
Комментарии0

AI-агенты тоже идут учиться 📚

К 1 сентября добавили агентам навыки — отдельные инструкции под конкретные задачи. 

Раньше все инструкции были в одном системном промпте. Больше задач → длиннее промпт → дороже каждое обращение к модели. Теперь инструкции раскладываются по навыкам, а это значит:

➖ Экономия токенов. В запрос уходит только компактный индекс навыка, полная инструкция добавляется под задачу. 

Порядок в логике. Один навык = одна задача, которую проще править, тестировать и понимать.

Переиспользование. Написали навык один раз — подключаете его любому агенту, не копируя текст между промптами.

Как начать применять:

1️⃣ Выберите повторяющуюся задачу: оформление ответов, работа с возражениями или сбор данных.

2️⃣ Создайте навык: название, условия применения и сама инструкция.

3️⃣ Подключите его к одному или нескольким агентам — дальше агент сам подтянет инструкцию, если запрос подойдет под условие.

Каждое изменение навыка сохраняется отдельной версией, между ними можно переключаться.

Отправить своего агента на учебу →

Теги:
+17
Комментарии0

Z.ai не доказала полную независимость Китая от Nvidia. Но кое-что что важное все же произошло

На прошлой неделе на OpenRouter появилась бесплатная анонимная модель под кодовым именем Ox Alpha. Без названия компании, пресс-релиза и привычного маркетингового разогрева.

За шесть полных дней она обработала 23,2 трлн токенов и стала самой используемой моделью на платформе — с отрывом в 2,3 раза от ближайшего конкурента.

26 августа Z.ai раскрыла карты: под именем Ox Alpha тестировалась её новая модель GLM-5.3-Flash.

Но самое интересное здесь не место в рейтинге и даже не цена. Весь трафик анонимного запуска, по заявлению Z.ai, обслуживался на китайских ИИ-ускорителях.

Ox Alpha занимает первое место на OpenRouter по числу обработанных токенов
Ox Alpha занимает первое место на OpenRouter по числу обработанных токенов

Трафик OpenRouter за 20–25 августа 2026 года. Источник: официальный релиз Z.ai.

1. Экономика сильных моделей меняется быстрее, чем кажется

На момент публикации миллион входных токенов GLM-5.3-Flash на OpenRouter стоит $0,075, выходных — $0,25. Для GLM-5.3 это $1,25 и $4,40.

Первая цена акционная, поэтому строить долгосрочную экономику только на ней не стоит. Но даже стандартный тариф Z.ai — $0,15 за вход и $0,50 за выход — заметно ниже стоимости большинства моделей сопоставимого уровня.

При этом на внутреннем Z.ai Code Bench v1.0 новая модель на максимальном режиме рассуждения почти сравнялась с Claude Opus 4.8: 29,0 против 29,5 балла.

Важно: Z.ai Code Bench v1.0 — закрытый тест самой компании. По состоянию на 30 августа его задания не опубликованы, поэтому результат нельзя независимо воспроизвести. Считать эти цифры доказательством одинакового качества не корректно.

То есть честная формулировка звучит не как «то же качество в десять раз дешевле», а так: модель уже находится в сопоставимом классе и стоит достаточно дёшево, чтобы её обязательно проверить на собственных задачах.

2. Низкая цена появилась не из воздуха

GLM-5.3-Flash — MoE-модель: всего в ней 320 млрд параметров, но при обработке каждого токена активируются только 18 млрд. Кроме того, в ней 45 слоёв против 92 у сопоставимой по общему размеру GLM-4.5.

Для работы с длинным контекстом объединили механизмы внимания:

  • линейное внимание обрабатывает локальные зависимости через состояние;

  • разреженное внимание находит релевантные фрагменты во всём контексте через отдельный индексатор;

  • IndexPool дополнительно сжимает четыре ключевых вектора индексатора в один.

По расчётам компании, по сравнению с GLM-5.3 это уменьшает вычисления механизма внимания примерно в три раза, а объём KV-кэша — в 4,4 раза на контексте до миллиона токенов.

Если убрать технические детали, смысл простой: модель тратит меньше вычислений и памяти на каждый запрос. Поэтому низкая цена здесь выглядит не только как субсидия для захвата рынка, но и как следствие архитектуры.

Конкуренция в ИИ всё заметнее смещается от гонки за «самую умную модель» к оптимизации всей системы: модели, движка инференса, памяти, сети и железа.

3. Китайское железо прошло проверку массовым инференсом

В течение всего анонимного запуска запросы к Ox Alpha обрабатывал крупный кластер китайских ИИ-ускорителей.

Для него Z.ai построила собственный стек инференса поверх SGLang: с разделением этапов обработки запроса, несколькими видами квантизации, оптимизацией обмена данными и отдельным планированием вычислительных пулов. Компания утверждает, что в результате производительность выросла втрое относительно первоначальной версии на том же оборудовании, а стоимость одного токена стала сопоставима с массовыми решениями на Nvidia.

Ещё одно важное уточнение: речь идёт об инференсе — обслуживании пользовательских запросов. Публичных доказательств того, что GLM-5.3-Flash была полностью обучена без оборудования Nvidia, пока нет.

Это различие принципиально. Обучить большую модель с нуля и обслуживать уже обученную модель в продакшене — разные по сложности и требованиям задачи.

Но результат всё равно значимый. Он показывает, что китайское оборудование уже способно выдерживать массовый трафик модели передового класса, а локальный программный стек — компенсировать ограничения отдельных чипов на уровне кластера.

Теги:
+8
Комментарии0

Воркер-группа растет вместе с кластером

Раньше, когда кончались ресурсы в кластере, приходилось создавать новую воркер-группу и переносить нагрузку на нее. Теперь все гораздо проще: добавили возможность увеличить текущую группу без пересоздания.

1️⃣ Проект вырос и поды уперлись в лимиты CPU и памяти → повышаете тариф воркер-группы, кластер остается прежним.

2️⃣ Нужна более гибкая настройка → переходите с тарифа на конфигуратор и собираете ресурсы под задачу.

Учтите, что апгрейд доступен только внутри вашей тарифной линейки. При изменении конфигурации воркер-ноды перезагружаются по очереди, чтобы не останавливать кластер.

P.S. Это не все апдейты Kubernetes — остальные публикуем на канале @twc_changelog

Дать нодам больше мощности →

Теги:
+20
Комментарии0

Люди восстали против ИИ

В США введено уже более 500 ограничений в отношении создания ЦОДов для ИИ в различных штатах. Причина — в протестах жителей против возведения новых дата-центров: такие объекты требуют значительного количества воды и энергии. В результате для местных жителей эти ресурсы дорожают или вовсе оказываются недоступны.

Теперь компаниям недостаточно просто денег, чтобы ввести в строй новый дата-центр. А как же законы свободного рынка?

Проблема водо- и энергопотребления дата-центров известна давно. Но сейчас она наиболее ярко проявилась, когда ведущие ИТ-компании вложили более триллиона долларов в новые вычислительные мощности. Ни одна сервисная компания не готова к кратному росту запроса на её ресурсы, поэтому повышает цены. К тому же ИИ-компании и ИТ-корпорации имеют достаточно ресурсов, чтобы оплатить коммунальные ресурсы по новым ставкам. А жители — нет. И возникает напряжение на уровне региональных управлений: чиновники рады притоку денег, но получают протесты жителей, вплоть до угроз жизни и местами даже стрельбы. Можно ли решить этот вопрос?

Дикий капитализм давно умер, нельзя продавать за кеш компаний благополучие простых граждан. Но инвестиции в ИИ тоже должны реализоваться, иначе банкротство топовых ИИ-стартапов может сказаться на всей ИТ-индустрии. Поэтому логично, чтобы региональные власти при строительстве коммуникаций учитывали потребности как общества (в воде и электричестве), так и бизнеса (в них же для дата-центров). Потребности людей должны стоять на первом месте, но важно, чтобы правила для всех игроков рынка устанавливались сразу и не было одномоментного роста арендных ставок в 68 раз! ИТ-бизнес сейчас испытывает множество сложностей, начиная с резкого роста цен на компоненты и заканчивая высокой ставкой ЦБ.

Если у бизнеса будет возможность долговременного планирования, то он сможет найти решения для дата-центров — переход на сберегающие технологии, перенос в регионы с холодным климатом, покупка собственных энергетических и вододобывающих мощностей. Но такие проекты всегда стоят дорого и требуют времени на реализацию, внезапные скачки цен только стимулируют отложить развитие до лучших времён, а значит, и не позволят снизить цены за счёт введения новых мощностей.

Человек может успешно воевать против ИИ, только потом он вернётся домой и захочет запустить LLM — кажется, в интересах обеих сторон договориться.

Теги:
+20
Комментарии1

SimpleOne 1.35.0 сокращает объём ручной настройки SLA и рабочих процессов

Вышла новая версия Low-code платформы SimpleOne 1.35.0. Обновление сокращает количество ручных действий при настройке SLA и рабочих процессов, снижая нагрузку на администраторов и ускоряя внесение изменений в систему.

Что нового:

  • Гибкая настройка индикаторов SLA — момент запуска, момент превышения, расписание и часовой пояс теперь можно определять на основе данных из связанных записей. Один индикатор способен учитывать контекст обращения автоматически, вместо создания десятков похожих под каждую комбинацию условий.

  • Копирование блоков в рабочих процессах — настроенный блок действия можно скопировать с сохранением всех параметров и вставить в тот же или в другой рабочий процесс, не создавая логику заново.

  • Массовое редактирование в связанных списках — изменения теперь можно вносить сразу в несколько записей связанного списка прямо на форме, без перехода в отдельное представление.

Подробнее в видео

Техническая документация

Теги:
+3
Комментарии0

Готовность к агентам — 99%

Когда вы просите Cursor или Claude что-то развернуть на Timeweb Cloud, агент идет в нашу документацию. Таких визитов уже треть от всех обращений к доке — посчитал наш руководитель разработки Миша Шпаков в статье.

Вывод простой: понятные инструкции нужны и агентам. Доработали их и получили 99 из 100 в AFDocs.

Вот как это повлияло на ваши запросы к доке:

1️⃣ В сотни раз меньше токенов — добавили llms.txt и llms-full.txt. С чистыми текстовыми версиями доки на страницу теперь уходит около 1 100 токенов вместо 295 000.

2️⃣ Задачи доходят до конца — подняли рейт-лимиты, чтобы частые запросы проходили без блокировок, а страницы быстро загружались из кэша.

3️⃣ Агент читает то же, что и вы — для этого выровняли разметку HTML- и MD-версий. Теперь никаких расхождений или устаревших данных.

Показать документацию своему агенту →

Теги:
+17
Комментарии0
1
23 ...