Обновить
512K+

IT-инфраструктура *

Инфоцентры + базы данных + системы связи

560
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

Может ли дата-центр вообще отказаться от воды?

Уровень сложностиПростой
Время на прочтение3 мин
Охват и читатели5.8K

Немного экспериментальный формат, который надеюсь, вам зайдет. Мне лично очень нравится изучать разные темы вне статистики, аналитики и прикладных к ним темам, поэтому иногда для того, чтобы лучше разобраться с какой-то темой лучше всего ее попробовать объяснить или описать самостоятельно.

В данном материале речь пойдет про ИИ, но немного с непривычного формата - попробуем разобраться, зачем охлаждают и чем сейчас охлаждаются дата-центры, в которых происходят все расчеты того, какой шампунь для волос нам выбрать или как написать слово "винегрет" без ошибок. И за каждым таким ответом стоят серверы, а серверы эти во время работы выделяют довольно много тепла.

Читать далее

Новости

Эволюция пайплайна метрик: как менялась архитектура с ростом нагрузки

Уровень сложностиСредний
Время на прочтение18 мин
Охват и читатели4.6K

Привет, Хабр! Я Руслан Боярский, SRE в Т-Банке, отвечаю за надежность платформы Sage и принимаю активное участие в ее развитии. Sage — это платформа наблюдаемости, где мы собираем телеметрию. И я регулярно убеждаюсь, что в ИТ мы не можем существовать без метрик.

В статье рассказываю о том, как с ростом нагрузки более чем в 100 раз может меняться и развиваться система мониторинга, подходы в командах, да и в целом сами команды. Покажу ключевые эпохи развития нашей подсистемы метрик. В каждой эпохе дам контекст, архитектуру, профиль нагрузки.

А еще опишу проблемы, с которыми можно столкнуться, и расскажу, как мы их решали. Попутно будет пара историй про инциденты. Поехали.

Читать далее

От архитектуры RISC-V в ЦОД до 256-ядерных чипов Diamond Rapids: новинки серверного железа за август 2026

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели7.2K

Август 2026 года выдался насыщенным с точки зрения новинок. Hot Chips 2026 и Flash Memory Summit принесли целую волну анонсов железа: от рекордных SSD до процессоров с гигабайтами кэша, а еще все, что раньше считалось памятью, теперь становится хранилищем, и наоборот. Собрали самое интересное из того, что появилось на рынке в августе, в традиционном дайджесте Selectel.

Читать далее

ЦОД в Марфино. Часть 18: итоги лета

Время на прочтение2 мин
Охват и читатели4.4K

Лето на площадке в Марфино выдалось насыщенным. Собрали в одном выпуске всё, что произошло за эти месяцы, — и рассказываем, как продвинулась стройка.

Читать далее

Camunda 7 все. Что делать тем, кто на ней остался

Время на прочтение10 мин
Охват и читатели3.8K

14 октября 2025 года вышла Camunda 7.24. Это был последний релиз Community Edition. GitHub‑репозиторий переведен в архив, issue закрыты, патчей безопасности больше не будет.

Никаких громких заголовков по этому поводу не случилось. А между тем на Camunda 7 в России работают сотни систем: кредитные конвейеры, согласование документов, клиентские заявки, внутренние процессы госкомпаний. Все они теперь работают на движке, который больше никто не поддерживает.

Сразу дисклеймер: у нас в Диасофт есть своя BPM‑платформа на форке Camunda 7, поэтому тема миграции нам небезразлична. Но разберем варианты честно, даже те, где наше решение не нужно.

Читать далее

Прятал пакеты и все отрицал — как мы отладили DHCP‑балансировщик

Уровень сложностиСложный
Время на прочтение10 мин
Охват и читатели7.7K

TL;DR: После миграции отказоустойчивого DHCP-сервера из «брони» QinQ-туннеля в «плоский» VLAN ответы от бэкап-ноды начали бесследно исчезать. Пакет физически покидал хост, но до адресата не доходил, при этом коммутаторы клялись, что их счетчики дропов равны нулю. 

Вооружившись tcpdump, тотальным port mirroring и дзен-терпением, мы раскрыли заговор: dhcp snooping молча уничтожал пакеты на уровне аппаратного ASIC. Самое пикантное: стек M-LAG с идентичной прошивкой вел себя радикально иначе, чем одиночный коммутатор в той же сети.

Добро пожаловать в мир сетевой магии, где порт 67 (six-seven) — это не просто абсурдный вирусный мем, а реальная причина, по которой инфраструктура вдруг решила сыграть в прятки.

Привет! Меня зовут Иванов Владимир, я системный администратор отдела выделенных серверов в Selectel. Статья будет полезна тем, кто сталкивался с ситуацией, когда пакет «в провод уходит, но не приходит», а сетевое оборудование клянется, что ничего не дропает.

Расследовать →

На что обратить внимание при выборе вендора системы электронного документооборота

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели5K

Рынок программного обеспечения в 2026 году заметно отличается от того, каким он был еще 4 года назад. Импортозамещение ускорило развитие технологического рынка, сегодня компаниям есть, из чего выбрать.

Как не ошибиться? Что спросить на первой встрече?

Узнать

Статистический анализ интереса к искусственному интеллекту в России 2022–2026 гг

Уровень сложностиСложный
Время на прочтение25 мин
Охват и читатели4.6K

Статья посвящена статистическому анализу интереса к искусственному интеллекту в России в 2022–2026 гг. Интерес рассматривается как многомерное явление и операционализируется через четыре группы индикаторов: информационную осведомленность населения, поисковый спрос, фактический опыт использования генеративных ИИ‑сервисов и интенсивность регулярного взаимодействия с ними.

В анализ включены данные ИСИЭЗ НИУ ВШЭ и Яндекс Wordstat, мониторинговые исследования ВЦИОМ, медиаметрия Mediascope Cross Web, обезличенные данные операторов и цифровых платформ, а также продуктовые показатели российских ИИ‑сервисов. Результаты показывают переход от фазы быстрого роста узнаваемости технологии к фазе массового практического использования.

Читать далее

Как AI используется в NGFW в 2026 году: российские решения и мировой опыт

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели6.7K

Машинное обучение для обнаружения угроз, AI-помощник администратора и контроль доступа к провайдерам нейросетей. Разберём, как NGFW-решения адаптируются к AI-изменениям ИТ-ландшафта. Что нового у российских и зарубежных вендоров, где заканчиваются возможности межсетевого экрана и какое место в AI-трансформации сетевой безопасности занимает Ideco.

За словами «AI в NGFW» скрываются разные технологии

Сравнивать межсетевые экраны нового поколения, NGFW (Next-Generation Firewall), по наличию «искусственного интеллекта» почти бессмысленно. Например, Cisco предлагает генеративного помощника в системе управления, а Ideco сочетает распознавание AI-сервисов с отдельной AI-аналитикой событий безопасности и конфигурации межсетевого экрана.

Поэтому вместо общего рейтинга «интеллектуальности» сравним четыре сценария:

Читать далее

Ваш test — это prod

Уровень сложностиСредний
Время на прочтение9 мин
Охват и читатели8.3K

Просто вы его так не назвали. Открытый стандарт EnvSpec Naming 1.0 — о том, что имя ресурса это модель доверия, а не удобство админа.

Стенд UAT с боевой выгрузкой — это prod по определению. Хост srv-msk-prod-db-tier1-old-02 не говорит машине ничего. Открытый стандарт EnvSpec Naming предлагает считать имя ресурса системой координат для ИБ, DevOps и инвентаризации.

Читать далее

Что будет с телеметрией, если хранилище исчезнет: сравниваем очереди и батчинг семи агентов

Уровень сложностиСредний
Время на прочтение17 мин
Охват и читатели7.3K

Когда выбирают агент для телеметрии, обычно сравнивают поддержку протоколов, потребление CPU и удобство конфигурации. Я бы начал со следующего вопроса:

> Что произойдёт с данными, если хранилище перестанет отвечать на 30 минут, а потом вернётся обратно?

Агент-доставщик может уметь в ретраи, персистент вольюм, но это не означает, что данные не потеряются. Ретраи должны где-то жить, а очередь должна иметь предел. После восстановления связи накопившиеся сообщения нужно выгрузить, не положив только что ожившее и еще не до конца очухавшееся хранилище. А если агент вдруг неожиданно перезапустится, очередь должна пережить и это.

Меня зовут Антон Касимов, я работаю в Gals Software, веду авторский телеграм по наблюдаемости Мониторим ИТ, а в этой статье разберу семь популярных шипперов и коллекторов: OpenTelemetry Collector, Grafana Alloy, Vector, Fluent Bit, vlagent, vmagent и vtagent. Для каждого шиппера рассмотрю следующие вещи: батчинг, очередь, поведение при недоступности бэкэнда, ключевые настройки и минимальный пример конфигурации.

Это не синтетический рейтинг кто быстрее, выше, сильнее. У инструментов разная специализация и разные единицы измерения. Очередь в 1000 OTLP-запросов нельзя честно сравнить с очередью в 10 ГБ или с WAL длительностью восемь часов. В проектах я сам периодически сталкиваюсь с проблемой выбора, поэтому тема для меня достаточно животрепещуща. Возможно, она окажется такой и для вас.

Читать далее

Успеть за 15 минут ̶и̶ ̶н̶е̶ ̶п̶о̶д̶р̶а̶т̶ь̶с̶я̶ ̶в̶ ̶р̶е̶г̶и̶с̶т̶р̶а̶т̶у̶р̶е̶. Как устроен цифровой маршрут пациента

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели8.8K

По нормам Минздрава, на прием терапевта отведено 15 минут. За это время врачу нужно успеть выслушать жалобы, поднять историю болезни, изучить анамнез, осмотреть пациента и зафиксировать результат так, чтобы его сразу понял следующий специалист. 

Чтобы это стало возможным, под капотом клиники работают десятки согласованных ИТ-процессов. И любая мелочь вроде дублированной записи или сбоя синхронизации расписания может превратиться в очередь, срыв приема и поток раздраженных пациентов (привет, 90-е). 

В этой статье разбираем цифровой маршрут пациента от онлайн-записи до телемедицинской консультации: как устроен master расписания, что защищает от двойного бронирования, как работает электронная очередь и каким образом ИИ помогает врачу за отведенные минуты принять решение, от которого зависит здоровье пациента. 

Читать далее

VM в нетипичных средах: АСУ ТП, сеть, IoT, мобильные устройства, железо и ML (перезалив)

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели6.4K

Процесс VM везде один, но дьявол в деталях. Где в АСУ ТП нельзя просто запустить сканер, какие сетевые уязвимости встречаются чаще всего, почему полмиллиона камер и роутеров с дефолтным паролем однажды положили половину интернета, что такое prompt injection в ML-системах и где прячутся уязвимости на уровне прошивок и процессоров (Spectre, BadUSB). Обзор специфики разных сред (перезалив)

Читать далее

Ближайшие события

Как ИТ-директору посчитать эффект от сервисной автоматизации

Время на прочтение9 мин
Охват и читатели6.5K

В кризис ИТ-директор не может менять процессы и внедрять автоматизацию наугад: риск потратить бюджет впустую слишком велик. Когда в планах оптимизация сервисных процессов, обычно нужен бюджет на новое решение, например ESM-платформу. При защите бюджета финдир спросит про пользу и окупаемость, и цифра эффекта должна быть проверяемой.

Дальше в статье — методика расчета эффекта: сколько времени и денег экономит автоматизация сервисных процессов. ROI и срок окупаемости эта методика не считает: они складываются из эффекта и стоимости внедрения, а стоимость внедрения ИТ-директор получает отдельно, от вендора, на этапе коммерческого предложения. Эффект — числитель в формуле окупаемости, и в статье разберём именно его.

Читать далее

Отреверсили проприетарный gRPC и выложили в опенсорс 100% совместимый аналог их сервера, потом CLI

Время на прочтение8 мин
Охват и читатели88K

А вы тоже организуете общение между микросервисами по HTTP/1.1 + JSON? Так вот, адекватные люди на хайлоаде давно так не делают.

Как это выглядит в классическом REST: какой-нибудь сервис заказов стучится в сервис оплаты и отдаёт JSON-файлик: {"user_id": 123, "amount": 1000}. Принимающий сервис этот текст читает, парсит, валидирует, переводит в машинный код...

JSON сделан для людей. Человеку удобно читать JSON, потому что это текст. Но серверу для обработки текста приходится тратить драгоценные такты процессора на поиск и разбиение. Ещё классический HTTP тащит за собой гигантские заголовки с метаданными. Часто они весят больше, чем сама полезная нагрузка. Ещё если вы передаете число 123456789, в JSON оно займёт 9 байт (по байту на символ), а в бинарном виде — всего 4 байта.

Гугл ещё в 90-х это посчитал. Они со своими масштабами столкнулись с проблемами за 10 лет до того, как с ними столкнулся весь остальной мир. Для DNS-а в Гугле сделали внутреннюю систему Borg-NS. Они пытались сделать предка gRPC, чтобы решить две фундаментальные проблемы. Во-первых, зоопарк технологий. Когда у тебя тысячи микросервисов — одни на Java, другие на C++, третьи на Python, четвёртые на Go (ладно, этих тогда точно не было) — им нужен единый язык общения. Нужно было запилить стандарт: описали спецификацию интерфейса в одном независимом стиле — и система сама сгенерировала готовый сетевой код для всех нужных языков.

А во-вторых — это как раз производительность обмена.

Поэтому сейчас используется gRPC. И вот когда началась какая-то там по счёту волна санкций, внезапно выяснилось, что в России нет поддержки серверов gRPC.

Читать далее

Как перейти на Infrastructure as Code и выжить

Уровень сложностиПростой
Время на прочтение7 мин
Охват и читатели7.3K

Привет, Хабр! На связи инженеры департамента информационных технологий iCore.

В любой быстрорастущей компании наступает момент, когда ИТ-инфраструктура начинает масштабироваться нелинейно. Бизнес требует новые функции за дни, масштабироваться под нагрузки за часы и обеспечивать отказоустойчивость сразу, «из коробки. Изменений становится все больше и больше, растет число виртуальных машин, микросервисов и окружений. Команде с одной стороны нужно поддерживать работоспособность постоянно растущей инфраструктуры, а с другой – обеспечивать возможность этого роста.

В этих условиях классическое ручное администрирование заходит в тупик. Появляются и копятся временные решения – «костыли», документация устаревает в момент написания, а расследование любого инцидента превращается в детектив с поиском того, кто и когда изменил конфиг в обход всех регламентов (они, кстати, тоже не успевают обновляться и соответствовать темпам роста).

Читать далее

Железо для ИИ: почему стандартный сервер не справится и как мы проектировали аппаратный стек ПАК

Уровень сложностиСложный
Время на прочтение14 мин
Охват и читатели6K

Привет, Хабр! Продолжаем цикл про инфраструктуру для ИИ-задач. В первой статье мы разбирали стратегический вопрос: что проще и выгоднее — собирать самостоятельно или брать готовый ПАК (на примере ПАК Скала^р)? Поговорили и о том, что именно заказчик узнает о самосборе — не на этапе закупки, а через полгода эксплуатации. 

Сегодня же переместимся на следующий уровень: поговорим про аппаратный стек.

Структура статьи такова: для каждого слоя железа — GPU, питание, охлаждение, хранение — я покажу, какую инженерную задачу мы решали при проектировании ПАК и почему приняли именно такие решения, а не другие. Там, где это уместно, приведем цифры, которые помогут понять пороги: когда одно решение заменяется другим и что это означает по деньгам и по производительности.

Поехали!

Читать далее

Платформа данных на минималках. Часть 3. Вычислительный движок

Уровень сложностиСложный
Время на прочтение39 мин
Охват и читатели7.5K

Привет! Я Денис, старший бэкенд-разработчик в Selectel. В предыдущих частях мы познакомились с архитектурой Apache Iceberg, а также развернули и настроили каталог метаданных.

Итак, у нас есть данные в S3‑хранилище, аккуратно организованные средствами Iceberg, и каталог, который знает расположение актуальной версии каждой таблицы. Казалось бы, все готово. 

Однако при ручном просмотре S3-бакета ничего похожего на таблицу не обнаружится — видны лишь вложенные папки с Parquet-файлами и JSON-метаданными. Да, Iceberg и каталог решили задачу хранения и версионирования, но не ответили на вопрос, как читать эти данные с помощью SQL.

И вот возникает практическая задача: как аналитику или инженеру обратиться к Iceberg-таблице посредством SQL, не поднимая Spark-кластер и не перенося данные в отдельную СУБД?

Осторожно! Под катом — лонгрид

Российские NGFW в 2026 году: метаанализ отраслевых тестов и практики эксплуатации

Уровень сложностиСредний
Время на прочтение13 мин
Охват и читатели5.2K

Ситуация на российском рынке NGFW-решений меняется. Он стал прозрачнее, тестировать самостоятельно десятки решений больше не нужно. Мы сопоставили открытые сравнения NGFW, лабораторные испытания, оценки рынка и исследования пользовательского опыта, чтобы разобраться, какие выводы из них действительно можно сделать.

Сразу обозначим позицию: это статья в блоге вендора, а не независимый рейтинг от нашего имени. Под метаанализом здесь понимается сопоставление результатов и методик актуальных исследований рынка NGFW России и обзор информационно-аналитического ландшафта.

Какие исследования легли в основу метаанализа

В основу статьи вошли восемь исследований и сравнительных проектов, перечисленных ниже. Они рассматривают рынок с разных сторон: от наличия функций до оценки производительности в рамках тестирования на стендах, пользовательского опыта, продаж и оценок зрелости отечественных решений.

Читать далее

Как проверить бэкап: тест восстановления за один день

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели3.9K

Бэкап запускается каждую ночь, отчеты приходят со статусом «успешно», а восстановиться после сбоя все равно может не получиться. Потому что резервная копия — это еще не готовность бизнеса к аварии.

В материале — как за один рабочий день, не трогая рабочую инфраструктуру, сделать тест восстановления, который вскрывает разрыв между «копия есть» и «бизнес снова работает», и показывает, сколько на самом деле займет возврат в строй.

Читать далее
1
23 ...