Обновить
512K+

IT-инфраструктура *

Инфоцентры + базы данных + системы связи

653,04
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

3 бита вместо 16: разбираем TurboQuant и когда его реально стоит включать

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели5.1K

В марте 2026 года Google публикует пост про алгоритм сжатия памяти для языковых моделей. Звучит скучно, правда? Но акции Micron, SanDisk, Samsung, SK Hynix и других производителей памяти за неделю теряют суммарно почти $90 млрд капитализации. Инвесторы паникуют: если модели начнут тратить в разы меньше памяти, то зачем столько железа?

Алгоритм, который навел весь этот шум, называется TurboQuant — герой этой статьи.

Я не буду говорить, что это «революция» или «переворот в индустрии» — это было бы явное преувеличение. Но штука действительно интересная, и уже есть рабочие реализации. Если вы деплоите LLM в продакшн или просто прогоняете модели локально, то вам 100% будет полезно об этом узнать. Разберем, что из заявленного правда, а что преувеличение, и главное — как это попробовать прямо сейчас.

Читать далее

Новости

Внутреннее устройство Bitcoin

Уровень сложностиСредний
Время на прочтение7 мин
Охват и читатели6.5K

В этой статье я постараюсь объяснить, как работает биткоин. Без аналогий с добычей золота и прочих глупостей.

Начать стоит с того, что он вообще из себя представляет. Биткоин, это одноранговая (P2P) сеть которая формирует механизм глобального консенсуса, который позволяет всем узлам сети договориться об общем состоянии леджера и дает возможность локально проверить весь этот леджер, не доверяя никому. Это система где есть только пользователи и нет администраторов. Это permissionless система, то есть вам не нужно ничье одобрение чтобы в ней участвовать. Используется эта система для формирования глобальной системы денег. Леджер хранит всю историю транзакций за все время, формируя цепочку блоков транзакций - блокчейн.

Если по-человечески то биткоин это просто глобальная универсальная книга бухгалтерского учета, где навсегда фиксируются все взаиморасчеты, где нет возможности смухлевать, отменить или оспорить перевод или создать деньги из воздуха.

Биткоин это не первая попытка создать систему такого рода, но ему первому это удалось. Биткоин решил две ключевые проблемы, которые до этого не удавалось решить никому.

Для понимания его устройства стоит начать стоит с криптографических примитивов, из которых он собран. Как только у вас будет понимание того, как каждый из них работает, понять устройство биткоина будет гораздо проще.

В его составные части входит:

Читать далее

Мы проверяли, что устройство работает. Оказалось — мы проверяли не то

Уровень сложностиСложный
Время на прочтение12 мин
Охват и читатели5.5K

Исправное устройство успешно обновилось, доказало своё здоровье, а через два перезапуска откатилось на старую прошивку. Причина оказалась вообще не в обновлении: в тот раз наш бэкенд отвечал три минуты вместо одной.

У нас парк ARM‑устройств: удалённое обновление ядра, A/B‑слоты, автоматический откат. Казалось бы, схема известная, готовые движки есть, документация написана. Сам движок действительно поехал за неделю. Потом полтора месяца мы выковыривали дефекты, которые не падали, ничего не писали в лог и не ловились обычными тестами.

Ниже — семь самых поучительных случаев. И у всех одна форма: каждая проверка утверждала больше, чем на самом деле доказывала.

Устройство говорило «обновился», проверив доставку обновления, а не его применение. Или: «я здоров, братан, проверяй», глядя на факт запуска, а не на работу прошивки. Или: «версия 0.0.17», потому что это было написано в манифесте бэкенда, а не потому, что именно эта версия реально крутилась на железе.

В итоге — как с нашим правительством: свою работу оценили на отлично, а эксперимент, очевидно, неудачный.

И чё?

Предиктивное обслуживание в промышленности: три системных условия, без которых технологии не работают

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели5.6K

Сотни миллиардов вложены в IIoT, предиктивную аналитику и цифровые двойники. Но часто проекты предиктивного ТОиР достигают технологического успеха — и операционного провала: модели верно прогнозируют отказы, а оборудование по-прежнему ремонтируют «по факту».

В статье разбираю три условия, без которых предиктивная диагностика не становится частью реальной работы.

Читать далее

Выбор платформы виртуализации для малых инсталляций

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели8.7K

Сегодня даже для небольшого бизнеса или образовательного учреждения «сервер» редко представляет собой одну физическую машину. Чаще в эту сущность упаковывают понятийно сразу несколько сервисов: файловое хранилище, веб‑сервер, базу данных и пр. Потому что запускать каждую службу на отдельном «железе» дорого, неэффективно и сложно в обслуживании. В этом случае на помощь приходит виртуализация — технология, позволяющая создать несколько изолированных виртуальных машин (ВМ) на одном физическом сервере.

Как выбрать правильную платформу, особенно когда у вас нет отдельного штата ИТ‑инженеров и огромного бюджета?

В нашей статье мы разберём ключевые критерии, на которые стоит обратить внимание при выборе системы виртуализации.

Читать далее

Один DNS‑запрос породил 329 запросов. Я полез разбираться, куда они все ушли

Уровень сложностиСредний
Время на прочтение11 мин
Охват и читатели8.9K

Один DNS‑запрос. Пустой кеш. И 329 исходящих запросов вслед за ним.

Сначала я решил, что где‑то неправильно понял цифры. Потом полез разбираться и выяснил, что recursive resolver внутри делает намного больше работы, чем видно по обычному dig.

Разбираю, откуда берутся эти сотни запросов, при чём здесь CNAME, glue, DNSSEC, IPv6 PTR и почему разные версии BIND на одном и том же запросе могут отличаться почти в три раза.

Читать далее

От спанов к сценарию агента: зачем мы добавили GenAI-представление трейса

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели8K

Трейс ИИ-агента можно открыть в обычном "дереве" и найти медленный вызов или спан с ошибкой. Но по дереву трудно восстановить логику запуска: сколько раз агент обращался к модели, какие инструменты вызывал, где повторил шаг и какой ответ в итоге увидел пользователь.

В Proto Observability Platform уже были дерево, граф, флейм-граф и другие представления трейса. Они продолжали решать инфраструктурные задачи, но ответы о поведении агента приходилось собирать вручную из десятков спанов, транспортных вызовов и повторяющихся тел сообщений. Мы увидели это сначала на OpenTelemetry Demo 3.0, затем при отладке собственного «AI-аналитика» в связке с нашим MCP-сервером.

В результате мы добавили отдельное GenAI-представление с четырьмя режимами: лентой, графом шагов, графом вызовов и чатом. Дальше покажем, на какой вопрос отвечает каждый режим, почему одного универсального графа оказалось недостаточно и какие дефекты реальной GenAI-инструментации пришлось учитывать.

Читать далее

Аналитик, или Туда и Обратно: как мы стали «Google на минималках» в мире контейнерной оркестрации

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели6.4K

Привет! Меня зовут Алиса, и сейчас я руковожу командой разработки продукта «Штурвал». У нас работает около пятидесяти человек:  инженеры,  безопасники,  девопсы, фронтендеры, бэкендеры на Go и тестировщики, которые ломают всё, что мы строим. Но сегодня я хочу рассказать не о них. Сегодня балом правят аналитики. И под катом объясню, почему. 

Читать далее

Шесть человек и root на чужие серверы: зачем я занялся выбором СЭД для учета доступов

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели6K

У меня хостинг-провайдер, в штате шесть человек. Когда я говорю, что мы внедрили СЭД, знакомые ржут: вам-то зачем, вас на одну переговорку хватит.

Пробежимся по цифрам. Шесть сотрудников и под сотню точек доступа, больше половины которых ведет не ко мне, а к клиентам. Учет всего хозяйства я вел в гугл-таблице. Заблудились мы в ней, когда нас было трое. Не шестеро, а трое.

Читать далее

Дронопорт на ГОКе: что он реально делает для маркшейдерской службы

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели6.3K

Дисклеймер. Пишу от своего имени и излагаю своё мнение — с учётом 15-летнего опыта в робототехнике. Прежде чем сесть за этот текст, я провёл порядка 20 полноценных встреч с разными специалистами: среди них геодезисты, маркшейдеры и поставщики оборудования. Так что это не пересказ встреч, а попытка свести в одно то, что я услышал «с земли».

Читать далее

Как разобрать и собрать заново видеоплатформу Okko, пока ей пользуются миллионы

Уровень сложностиСредний
Время на прочтение23 мин
Охват и читатели5K

Иногда легаси нельзя постепенно улучшить: его приходится разбирать, переосмысливать и заменять, пока основной продукт продолжает работать. Именно в такой ситуации оказались мы в Okko. Нам нужно было отделить воспроизведение от монолита, переписать транскодинг, заменить единовременно старую CMS и сохранить непрерывную работу онлайн-кинотеатра. В результате мы получили единую Видеоплатформу с документированными API, собственным кодированием 4K и HDR, управляемой аналитикой и возможностью разворачивать отдельные инсталляции для внешних партнёров.

Привет! Меня зовут Юлия, я представляю компанию Okko — один из крупнейших и старейших онлайн-кинотеатров России. Сервис появился в 2011 году и за это время вырос в сложный технологический продукт, ежедневно работающий с большими объемами видеоконтента и высокой нагрузкой.

В Okko я руковожу отделом discovery продуктов и сервисом «Видеоплатформа», и именно о нем пойдет речь в этой статье. Я расскажу, почему мы решили создать сервис, какие задачи перед собой поставили, с какими техническими и организационными вызовами столкнулись и как внедрили новую платформу без даунтайма основного продукта.

Читать далее

Как ИИ ускорил отказ индустрии от медных кабелей и переход на фотонный интерконнект

Время на прочтение13 мин
Охват и читатели9.5K

Привет! Я — Аля, старший продакт-менеджер выделенных серверов в Selectel. За последние полтора года в мире сетей для ИИ произошла серия событий, которые по отдельности выглядят как обычные корпоративные новости, но вместе они складываются в любопытную картину.

Broadcom с октября 2025 года серийно отгружает коммутатор Tomahawk 6 «Davisson» с оптикой, встроенной прямо в корпус чипа, а его предшественник разошелся десятками тысяч штук. NVIDIA анонсировала собственные коммутаторы с той же технологией и уже запустила их в производство. Marvell в феврале 2026 года купила стартап Celestial AI, сумма сделки — около $3,3 млрд. Стартап Ayar Labs в марте 2026 года привлек $500 млн при оценке $3,75 млрд, и среди его инвесторов одновременно NVIDIA и AMD. А Lightmatter инвесторы оценили в $4,4 млрд еще до первого массового продукта.

Все эти ставки сделаны на одну и ту же технологию — совместно упакованную оптику, CPO (co-packaged optics), то есть оптику, собранную в одном корпусе с чипом. Да, но оптика в дата-центрах — вообще-то не новость. Оптоволокно носит трафик между городами уже полвека, а между серверными стойками пару десятилетий. Что такого могли придумать в этой области, чтобы настолько разные компании синхронно понесли туда свои миллиарды? 

В статье разберемся, что такое совместно упакованная оптика, при чем тут фотонный интерконнект и что все эти компании на самом деле покупают.

Читать далее

Docker объявил об открытом бета-тестировании Docker VMM

Время на прочтение4 мин
Охват и читатели14K

Docker объявил об открытом бета-тестировании Docker VMM
Собственного, полностью переписанного слоя виртуализации, который отныне лежит в основе Docker Desktop. Новый движок уже доступен в паблик-бете на macOS и Windows начиная с Docker Desktop v4.86. Разберёмся, что именно поменялось, почему это важно даже тем, кто никогда не задумывался о VMM, и как всё это протестировать самостоятельно.

Читать далее

Ближайшие события

Связь в карьерах и шахтах: как использовать pLTE/5G в горной промышленности

Время на прочтение14 мин
Охват и читатели7K

Организовать надежную связь в открытом карьере или шахте — задача технически нетривиальная. Любой, кто с ней сталкивался, знает, как сложно обеспечить решение без проводов с нормальной скоростью: приходится одновременно проводить радиопланирование для очень сложных условий распространения сигнала и выбирать точки размещения оборудования в сложных условиях зоны ведения горных работ — учитывая сам план работ, ограничения по организации электропитания и каналов связи для транспорта между элементами беспроводной сети, выполняя требования по пылевлагозащите и взрывобезопасности. При этом нужно сделать это решение бесшовным, без прерывания сеансов связи (при переключениях между базовыми станциями) и с минимальным числом мертвых зон. А уж приоритизация трафика — это вообще задача со звездочкой для любой беспроводной сети, не только в карьере или шахте.

Какую технологию выбрать для работы в сложных, удаленных от больших городов условиях? Сразу появляется идея — накрыть рабочую зону Wi-Fi. Но у этой идеи сразу несколько ограничений: 

Низкие характеристики по покрытию, для покрытия значительной площади требуется установка десяток точек доступа, для каждой из которых требуется питание, канал связи, порты на сетевом оборудовании.
Wi-Fi может терять сессии при переключении между точками доступа.
Высокое затухание, высокая интерференция при переотражении.  
Нет механизмов управления задержками при загрузке канала трафиком, линейно возрастает уровень задержки 

В отличие от Wi-Fi технология pLTE позволяет достичь качественно иного уровня автоматизации горных процессов (включая подземные работы), обеспечивая детерминированную задержку и стабильное соединение в сложных условиях рудников и карьеров.

Поэтому в горной отрасли все чаще делают выбор в пользу в private LTE/5G при создании опорной инфраструктуру связи. Давайте разберем, как технология, рожденная для массовых звонков и стриминга видео, становится основой безопасности и рентабельности горного дела.

Читать далее

Копия почты по IMAP: опцию включает сотрудник, а не организация. Запретить — может, и то не всем

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели9.7K

Опция “С сервера imap.yandex.ru по протоколу IMAP” живёт в личных настройках сотрудника: справка Яндекса адресует все четыре шага владельцу ящика. Документация Яндекс 360 API описывает при этом обратное действие - enable_imap: false ограничивает работу через почтовые программы, причём до тех, кто уже включил доступ себе, этот параметр не достаёт. Разбираю, что эта асимметрия означает для инструментов, которые забирают почту по IMAP, и как за вечер проверить свой на тестовой учётной записи.

Разобраться с галочкой

Куда на самом деле попадает секрет при сборке Docker-образа: разбираем 8 способов

Время на прочтение8 мин
Охват и читатели6.9K

Секрет попал в Dockerfile, разработчик спохватился и добавил RUN rm. Файла в контейнере больше нет — значит, всё в порядке? Нет: строку по-прежнему можно достать из образа, даже не запуская контейнер. Я собрала восемь образов, в каждом передала секрет своим способом и разобрала результат на слои и метаданные. Ниже — где именно оседает секрет в каждом случае и какие два способа действительно не оставляют следов.

Все эксперименты выполнены на Ubuntu 24.04.1 LTS, Docker Engine 29.1.3, BuildKit v0.26.2.

Читать далее

Как перестать искать место для плат и начать тестировать

Время на прочтение7 мин
Охват и читатели11K

Привет, Хабр! Меня зовут Антон. Я работаю в группе разработки аппаратной поддержки СнК в YADRO. Моя команда занимается разработкой аппаратной и программной частей стендов для тестирования полупроводниковых продуктов, поэтому наша деятельность находится на стыке железа и программирования. А тестовая лаборатория — неотъемлемая часть нашей работы.

Мой рассказ будет состоять из двух частей. В первой я расскажу, как мы организовали лабораторию и разместили стенды. Во второй — покажу, какое оборудование помогает сделать работу инженеров быстрее и удобнее. 

Читать далее

Как оптимизировать расходы на инфраструктуру для искусственного интеллекта. Выбираем железо и модели под разные задачи

Время на прочтение12 мин
Охват и читатели8.7K

В отчете The State of AI 2025 агентство McKinsey заявляет, что 88% компаний уже используют ИИ хотя бы в одном бизнес-процессе. Grand View Research отмечает, что по их прогнозам глобальный рынок вырастет до 3,5 триллионов долларов к 2033. Уже сейчас мы можем отследить эту динамику.

Однако AI-сервисы не бесплатны. Компании, которые начали с токенизированных API, часто обнаруживают, что при реальной нагрузке их счета растут быстрее, чем польза от ИИ. Поэтому возникает вопрос: как развернуть искусственный интеллект на собственной инфраструктуре и не переплатить.

Привет! Привет! Меня зовут Сергей Ковалёв, я менеджер продукта в Selectel. В статье отвечу на этот вопрос, сравню токенизированные API с on-premise и разберу, когда собственное железо будет выгоднее арендованного. Подскажу, как выбрать модель в зависимости от задачи и GPU под разные сценарии: от простого чат-бота на L4 до многоагентных систем на HGX B300. А в конце дам пошаговый план, как перейти с токенов на собственную инфраструктуру и посчитать реальную стоимость запроса.

Читать далее

Как мониторить Java-приложения: метрики, алерты и правило 80/20

Уровень сложностиСредний
Время на прочтение12 мин
Охват и читатели8.6K

Хороший мониторинг помогает быстро понять, что происходит с приложением и куда смотреть в первую очередь. Для этого не нужно пытаться измерить всё: базовый набор технических метрик покрывает большинство типовых проблем, а бизнес-метрики, SLO и анализ аномалий помогают заранее замечать нетипичные отклонения. В Календаре мы называем этот подход правилом 80/20.

Всем привет! Меня зовут Настя, я бэкенд-разработчик в Яндекс 360 и отвечаю за надёжность Календаря. В этой статье я покажу, какие метрики стоит взять за основу, как выбирать полезные алерты и чем дополнять базовый набор для оставшихся 20%.

Читать далее

QMetro — метро‑кластер в СХД Qsan

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели3.9K

Безусловно, главной функцией в работе любой системы хранения данных является сохранность этих самых данных. Следующим пунктом уже идет обеспечение доступа к ним. А применение различных технологий, многие из которых уже давно стали стандартом де‑факто, позволяет объединить эти важнейшие вехи. В данной статье мы поговорим об одной из таких технологий — метро‑кластере, поддержка которого появится в СХД Qsan начиная с FW 4.3.0.

Читать далее
1
23 ...