Обновить
256K+

Облачные сервисы *

SaaS, облака и как в них живётся данным

188,06
Рейтинг
Сначала показывать
Порог рейтинга

Дайджест: новости за июль 2026

Рассказываем, что произошло в июле и объясняем, чем это может быть полезно.

🤖 Гига-помощник прокачался в управлении
Теперь через помощника можно установить ops-agent на ВМ и собирать еще более подробные данные о хостах для мониторинга и логирования. А еще ИИ-помощник научился по запросу менять размер диска и вычислительный ресурс кластера Evolution Managed Redis: диск можно увеличить на 20% и больше буквально в чате, не переключаясь в консоль.

🧠 AI Factory  —  цифровая среда для работы с генеративным ИИ
Evolution ML Inference — три апдейта для тех, кто гоняет модели в проде: монтирование бакетов S3 прямо в Docker RUN (для новых и уже созданных инференсов), кеширование CUDA Graph для быстрого масштабирования и стабильного serverless-инференса под пиковой нагрузкой, а также cron-расписание масштабирования GPU — можно заранее готовить ресурсы к нагрузке и экономить в тихие часы.

Evolution Foundation Models — пополнили каталог готовых к подключению моделей, а Guardrails Filter (инструмент для защиты чувствительных данных в запросах и ответах LLM) теперь в опенсорсе — можно смотреть код и встраивать в свои пайплайны.

Evolution Notebooks и Distributed Train — добавили статусы «Ожидает ресурсов» и «Подготовка окружения», чтобы было понятно, на каком этапе завис ноутбук или Jupyter Server. Для Distributed Train также обновили образ jupyter-cuda (Python 13.3) и Marimo Hub до 0.2.0 — с SSH-доступом для отладки, SSE-событиями для отслеживания статуса в реальном времени и более понятными ошибками при нехватке портов.

📈 Evolution Data Platform — комплекс управляемых сервисов для работы с данными
Evolution Managed Trino научился работать с каталогом Kafka — теперь топики можно объединять в одном SQL-запросе с данными из СУБД и S3.

☁️ Новости других сервисов Cloud.ru Evolution
Evolution Object Storage — обновили тарификацию для холодного и ледяного классов хранения (минимальный размер объекта 128 КБ, правило только для новых объектов), ограничили Bucket Policy до 64 КБ и добавили роль s3e.auditor для просмотра структуры хранилища без доступа к скачиванию — удобно для аудита и комплаенса.

Evolution Managed Kubernetes — поддержка версии 1.36. В резервном копировании появились инкрементальные копии — тип бэкапа выбирается прямо при создании плана.

В личном кабинете на главную добавили виджет «Баланс» — остаток средств и грантов, пополнение и промокоды в одном месте. А для контроля доступа появились роли «Наблюдатель организации» и «Наблюдатель проекта» — только просмотр, без лишних прав.

🏢 Cloud.ru Advanced и Облако VMware
Новый сервис Advanced GeminiDB — managed multi-model NoSQL с разделением compute и storage, API Cassandra (CQL, включая DynamoDB-совместимый режим), Redis и InfluxDB под кеш, сессии и временные ряды.

Terraform-провайдер обновили до 1.12.20 — поддержка DataPlane v2 для vpc-router и фикс обновления сертификата CCE. Advanced Data Warehouse Service научился создавать кластеры с раздельным хранением и вычислениями.

📽️Вебинары и обучение
Уже анонсировали вебинары на август и выложили записи за июль: 

А еще выпустили в открытый доступ целую линейку курсов Cloud.ru ML System Design, чтобы вы могли создавать качественные ИИ-продукты.

💼 Свежие кейсы
Рассказали, как Купер полностью перенес свою инфраструктуру в облако, сократил количество инцидентов, их длительность и снизил цену устранения сбоев.

Остаемся на связи! ✌️

Теги:
-2
Комментарии0

14 августа 2026 года проекту Telegram исполнилось 13 лет. В этот день в 2013 году мессенджер был официально запущен в виде клиента на iPhone.

Теги:
+3
Комментарии0

Эволюция ченжлога на сайте

Многие из вас предлагают идеи по развитию продуктов и следят за обновлениями. Чтобы отслеживать релизы было проще, даже если пропустили дайджест, мы переделали старый ченжлог в «Журнал обновлений». В нем записана вся история релизов, изменений и исправлений багов с лета 2024 года.

Что появилось:

1️⃣ Блок «Запланировано» — что сейчас в работе и выйдет в ближайшее время. Прежде чем нести фичу в «Идеи», стоит заглянуть туда.

2️⃣ Поиск — если нужно узнать, добавили ли нужные AI-модели или новую ОС в маркетплейсе.

3️⃣ Теги — показывают, к каким сервисам относится релиз.

4️⃣ Фильтр — по месяцам и сервисам, работает и вместе: например, все обновления S3 за июль.

А если следить за релизами удобнее в Телеграме, обновления дублируются в нашем канале @twc_changelog

Заглянуть в журнал обновлений →

Теги:
+10
Комментарии0

Anthropic со 2 августа 2026 года начала внедрять маркировку контента, созданного Claude. В сгенерированный текст встраивается невидимый водяной знак, который не влияет на смысл или читаемость и может сохраняться после копирования и некоторых правок. Это может усложнить использование Claude для написания дипломных работ, книг и исследований. Во все актуальные модели встроили криптометки по стандарту C2PA. Метки невозможно увидеть и они сохраняются даже при копировании на другие ресурсы.

Для файлов компания использует другой механизм — цифровые метаданные о происхождении контента по стандарту C2PA. Они могут добавляться, например, к изображениям.png и.jpg и позволяют проверить, обрабатывался ли файл Claude и не изменялся ли он после этого.

Маркировка распространяется не только на веб-версию Claude: она применяется к поддерживаемым моделям в API, Claude Code, Claude Cowork и Claude Tag, а также при использовании Claude через AWS, Google Cloud и Microsoft Foundry, где технические возможности платформы это позволяют.

При этом водяной знак не станет стопроцентным способом доказать, что текст написал именно ИИ. Если Claude, например, только отредактировал, перевёл или сократил текст человека, итоговый материал тоже может получить метку. А после сильной переработки, перефразирования, перевода или смешивания с другим текстом её можно потерять. Отсутствие метки также не доказывает, что контент был создан человеком. Anthropic обещает отдельно опубликовать инструменты и техническую документацию для обнаружения таких водяных знаков.

Нововведение связано с требованиями европейского закона об ИИ: для новых моделей, запускаемых в ЕС после 2 августа 2026 года, должна быть предусмотрена маркировка ИИ-контента. При этом Anthropic решила применять технологию не только в Европе, но и по всему миру.

Вариант, как можно вычистить маркировку контента, созданного Claude:

  • Текст — отредактируйте, перефразируйте или переведите на другой язык. Вам нужно внести как можно больше изменений. Другого способа спрятаться от детекторов пока нет.

  • Картинка — уничтожьте все метаданные. Несколько раз пересохраните в разных форматах или сделайте скриншот картинки.

  • Код — поменяйте название 3–4 ключевых переменных, перепишите архитектуру функций своими руками или прогоните весь код через форматировщик (например, Prettier или Black).

Теги:
+5
Комментарии3

Пользователь установил своему хомяку систему, которая считывает пробежки в клетке по беговому колесу и загружает эти данные в соцсеть для спортсменов Strava. На колесе установлен магнит и специальный датчик, который считает количество оборотов колеса. Микроконтроллер фиксирует время, скорость и дистанцию питомца, а потом эти данные загружается в спортивную соцсеть. Средний ночной пробег хомяка Молли составляет 10 км, а его личный рекорд — более 11 километров за ночь.

Теги:
+5
Комментарии1

Как аптечная сеть «36,6» снизила ИТ-расходы в 1,5 раза после переезда на bare metal

Аптечная сеть «36,6» росла, а инфраструктура за этим не успевала. Аналитические расчеты требовали все больше мощности, а ядро сети держалось на двух коммутаторах Cisco с потолком 1 Гбит/с — в часы пик из-за этого могли сбоить аптеки. Бюджет при этом растягивать не хотелось.

Решением стал переход на bare metal в Рег.облако. Собрали инфраструктуру, которая оставила «36,6» полный контроль над железом и дала запас мощности для роста.

Что сделали:

  • перенесли больше 400 виртуальных машин за два месяца, без простоев в бизнес-процессах;

  • в основном ЦОДе — хосты на AMD EPYC с памятью DDR5 и три системы хранения;

  • заменили ядро сети: вместо упиравшихся в 1 Гбит/с коммутаторов Cisco поставили масштабируемое программное решение;

  • добавили серверы с GPU под большие языковые модели и резервный ЦОД с объектным хранилищем S3.

В результате расходы на инфраструктуру снизились в 1,5 раза, производительность кластера выросла в среднем на 40%, а ключевой расчет ускорился с 22 до 16 часов. Подробнее о технической реализации — в кейсе на сайте Рег.облака.

Теги:
+5
Комментарии1

Режим стримера 🎮

Теперь можно спокойно снимать скринкасты, стримить работу в панели или шарить экран на демо-звонке. Нам, кстати, тоже стало заметно проще записывать для вас инструкции. Все потому, что в панели появился режим стримера.

Включаете — и панель сама блюрит конфиденциальные данные:

➖ Публичные IP-адреса
➖ Баланс
➖ Личные данные: ФИО, телефон, email
➖ Домены и почтовые ящики

Пока переключатель в меню профиля в правом верхнем углу. Позже переедет в настройки персонализации.

Попробовать на своей панели →

Теги:
+18
Комментарии0

GitHub превратили в TikTok — теперь новые библиотеки, инструменты и идеи для своих проектов можно находить обычными свайпами. Сервис Roamers показывает бесконечную ленту открытых репозиториев, почти как рилсы. Если войти через GitHub, рекомендации подстроятся под ваши интересы, но листать можно и анонимно.

Теги:
+4
Комментарии0

Представлен поисковик Hiz для тестовых и исследовательских целей, который анализирует игровые сайты с репаками, ROM и открытыми в свободном доступе играми, а затем собирает их в одну выдачу. Автор проекта пояснил, что сервис содержит 62 тыс. проиндексированных ссылок от 23 источников, при этом его база обновляется каждые шесть часов.

Теги:
+3
Комментарии0

Дайджест Рег.облака за июль

В июле запустили третий этап Free Tier — бесплатный облачный сервер, ресурсов которого хватает уже на бизнес-проекты. Плюс упростили работу с ispmanager, открыли линейку «Стандартные» в двух регионах, добавили готовые образы в аттестованный контур ФЗ-152 и поделились исследованием о спросе на облако и GPU. Ниже — главное.

Запустили третий этап Free Tier — теперь и для бизнес-нагрузок

Расширили бесплатный облачный сервер до конфигурации, которой хватает для корпоративных порталов, крупных интернет-магазинов и ресурсоемких сервисов. На третьем этапе Free Tier дает выделенный облачный сервер бесплатно на два месяца: два виртуальных ядра, 4 ГБ оперативной памяти и 40 ГБ NVMe. Сервер подходит для проектов на «1С-Битрикс», переноса крупных сайтов с виртуального хостинга, баз данных и подготовки CI/CD-сред.

Подробности — на странице программы.

Исследование: спрос смещается к облаку, bare metal и GPU

Посмотрели, как за два года изменился спрос бизнеса на инфраструктуру. В публичном облаке акцент сместился с запуска проектов на резервирование: снапшоты используют 35,2% компаний малого бизнеса и 37% среднего. В dedicated и bare metal стало больше крупных клиентов — число компаний с расходами выше 500 тыс. руб. в месяц выросло более чем вдвое.

Особенно вырос спрос на GPU: за январь–июнь 2026 г. потребление прибавило 507% год к году. Чаще всего берут NVIDIA A4000 — у 63% компаний, и приходят за ускорителями уже не только ИТ, но и электронная коммерция, производство, логистика и финансы.

Все цифры — в исследовании.

Управление ispmanager для выделенных серверов в личном кабинете Рег.облака

Теперь панель ispmanager для выделенных серверов можно заказать и настроить прямо в личном кабинете Рег.облака. Если панель уже подключена, в интерфейсе ЛК виден блок с доступами и ссылкой на саму панель на сервере.

Открыли линейку «Стандартные» в Москве-1 и Санкт-Петербурге-1

Добавили новые конфигурации в двух регионах. При заказе появился переключатель диска — хранилище можно подобрать под свою задачу сразу на этапе заказа.

Готовые образы GitLab, GitLab Runner, Nextcloud и Portainer в регионе Москва ФЗ-152

В аттестованном контуре появились предустановленные инструменты для разработки и совместной работы. Развернуть нужное решение в защищенной среде можно без ручной настройки.

Разобрали свои продукты в статьях

В июле вышли два продуктовых обзора на Хабре — если пропустили, читайте:

Желаем всем продуктивного месяца и спасибо, что следите за обновлениями Рег.облака!

Теги:
+4
Комментарии1

Все, что нужно знать DevOps-инженеру: сводка за лето 2026

Мы почитали за вас все release notes, статус-страницы, постмортемы и блоги, чтобы вы могли спокойно провести последний месяц лета. Вот краткая выжимка того, что реально стоит внимания.

⏰ Пять дедлайнов, которые уже наступили

  • Prometheus 3.5 LTS перестал поддерживаться 31 июля. Новая 3.13 LTS будет поддеживаться до 31 июля 2027. Лучше прямо сейчас запланировать переход всех инстансов Prometheus с 3.5 LTS и других устаревающих версий на актуальную 3.13 LTS. Не забудьте проверить совместимость стека и протестировать обновление в staging.

  • В Argo CD обнаружились три уязвимости. Утечка секретов через ServerSideDiff (CVE-2026-43824), обход авторизации (CVE-2026-42880) и RCE в repo-server (CVE-2026-15416). Затронуты 3.2.0–3.2.10 и 3.3.0–3.3.8, учитывая, что как раз вышла свежая версия 3.5, самое время обновиться.

  • Self-hosted runner ниже 2.329.0 не зарегистрируется. GitHub просто перестанет пускать к себе раннеров-старичков. Лучше обновиться, чтобы не словить падение CI/CD, на установку свежей версии теперь отводится 30 дней.

  • Неявная выкачка кода из форка в pull_request_target и workflow_run теперь запрещена. Если вдруг ваш пайплайн внезапно перестал видеть код PR — поздравляем, вы нашли у себя уязвимый workflow. Это была дыра в безопасности, через которую можно было украсть секреты или изменить ваш код прямо из PR.

  • Выпущены патчи Etcd: v3.7.1, v3.6.14 и v3.5.33. Они закрывают утечку watch-ответов через границы RBAC и неограниченное создание goroutine на TLS-handshake. Проверьте, не используете ли вы ту версию etcd, которая дает возможность читать ключи и DoS’ить кластер, ну и не забудьте обновиться.

⚙️Про куберы

Kubernetes научился более умно работать с GPU и другим специальным железом. DRA (Dynamic Resource Allocation) вырос из «пробной» технологии, в штатный механизм. Теперь можно описывать, какое именно устройство вам нужно при выделении, как его делить и что делать при отказе.

Linkerd научился замечать, что конкретный сервис уже перегружен, и направлять новые запросы к другим доступным репликам: у версии Linkerd 2.20 появилась rate-limit-aware балансировка, а destination controller основательно переработали.

Istio добавил экспериментальный agentgateway — отдельный gateway‑proxy для ИИ‑агентов и MCP‑серверов. Еще развивается ambient multicluster: можно соединять сервисы в нескольких Kubernetes‑кластерах в одну mesh‑сеть без sidecar’а в каждом поде.

⛓️‍💥Про цепочки поставок

4 августа произошла масштабнейшая атака на цепочку поставки npm: в более чем 400 легитимных JavaScript‑пакетов встроили червя ChainDrop, который при установке крадет секреты разработчика или CI/CD и с украденным npm‑токеном сам заражает следующие пакеты. Работа для каждого на ближайшие недели — проверить dependency tree и lockfiles на скомпрометированные версии, очистить npm/yarn‑кеши в CI и на рабочих машинах, ну и отозвать и перевыпустить все доступные там секреты с чистого хоста.

CISA обновила минимальные элементы SBOM: подпись автора, инструмент генерации, хеш и алгоритм, лицензия, явные unknowns, машиночитаемость. CRA тоже требует вести машиночитаемый SBOM, поэтому тем, кто работает с рынком ЕС, уже стоит встроить генерацию и хранение SBOM в CI/CD: с декабря 2027 года он станет обязательным.

📊Про наблюдаемость

OpenTelemetry стал graduated-проектом CNCF, это по факту означает, что теперь у нас есть вендоронезависимый стандарт для сбора метрик, логов и трейсов, на который можно опираться при построении наблюдаемости.

Loki 3.6 получил горизонтально масштабируемый compactor. Теперь часть тяжелой работы по удалению логов можно раздать worker‑репликам. Но функция пока экспериментальная.

Grafana Alloy закрепился как официальный дистрибутив OTel Collector. Теперь, если вы строите или обновляете пайплайн сбора телеметрии на Grafana‑стеке, Alloy становится стандартным кандидатом №1, хоть функция пока экспериментальная.

Мы бы рассказали еще про статьи в нашем блоге на тему DevOps, но не можем — места нет.

Теги:
+6
Комментарии0

Не отдавайте базу знаний чужому ассистенту

Wake word устройство ловит локально, а дальше все идет на сервер: ASR переводит звук в текст, NLU достает интент, система выполняет действие, TTS озвучивает ответ. Сервер при этом чаще всего чужой. Вместе с аудио туда попадает и то, на чем ассистента обучали — внутренние инструкции, переписка, документы.

В статье разобрали путь команды от микрофона до ответа и объяснили, почему модели спотыкаются на омофонах и шуме.

Подробности — в блоге Рег.облака.

Теги:
+4
Комментарии0

Миграция корпоративных коммуникаций - это не только перенос почты. Компаниям необходимо сохранить документы, календари, учетные записи и историю переписки, а сотрудникам доступ к привычным рабочим инструментам.

12 августа в 11:00 МСК пройдет бесплатный вебинар «Импортозамещение ≠ долго, дорого, формально. Миграция корпоративных коммуникаций: опыт VK WorkSpace и кейсы крупных компаний».

Эксперты VK Tech расскажут, как подготовить инфраструктуру к переходу, какие данные можно перенести в SaaS-версию и нужно ли при этом останавливать работу на прежней платформе. Отдельно разберут возможные ошибки при миграции, восстановление неперенесенных данных и адаптацию сотрудников после запуска новой системы.

В прямом эфире покажут работу сервисов VK WorkSpace: почты, календаря, мессенджера, видеоконференций, документов, облачного диска и таск-трекера. На примерах крупных компаний спикеры объяснят, сколько времени может занять переход и какие сложности обычно возникают в процессе. Вебинар проведут Сергей Кирсанов, менеджер по развитию продаж VK WorkSpace, и Иван Бородин, пресейл-архитектор VK WorkSpace.

Теги:
+8
Комментарии0

Ближайшие события

Первые шаги на сервере: что быстрее освоить — консоль или ispmanager

У новичка на сервере обычно два пути: открыть панель управления в браузере или подключиться по SSH и разбираться с командами. Панель дает готовые формы под типовые операции, консоль — прямой доступ к системе. Освоить панель получится быстрее, но Linux под ней никуда не денется.

В статье сравнили оба подхода по сильным и слабым сторонам, разобрали сценарии для разработчика, владельца сайта и системного администратора и собрали минимум знаний Linux, который понадобится даже при работе через панель.

Подробности — в блоге Рег.облака.

Теги:
+4
Комментарии0

Раздел "Открытые реестры" сайта ФИПС лежит уже не первый день... интересно - в чем причина...

Причем сам сайт доступен, можно посмотреть каталог свидетельств о регистрации ПО, например... но при попытке просмотра карточки самого свидетельства выходит ошибка...

Иногда выходит 404 от сервера Payara версии 5.193...


посмотрим, поднимется ли он с утра понедельника...

P.S.: понятно, что это не критичный вроде бы сервис и т.п.... но в целом много вопросов в голове возникает на связанные темы об эффективности работы ИТ в бюджетной сфере...

Теги:
+6
Комментарии1

В конце июля 2026 года Google выкатила возможность генерировать по промпту с помощью ИИ для генерации изображений Nano Banana разные объекты на картах Google Earth. Инструмент позволял приблизить любую точку на карте и создать там новый снимок по текстовому запросу. В Google предлагали использовать эту опцию для визуализации исторических событий, инфографики, архитектуры и планирования строительства. Инструмент был доступен пользователям по всему миру.

Пользователи сразу начали создавать на картах взрывы ядерных бомб в разных местах и различные разрушения. После этого в Google через пару часов поняли, что натворили и быстро убрали опцию из общего доступа.

В Google подчеркнули, что сгенерированные изображения были помечены как созданные ИИ и не отображались в основной версии Google Earth для других пользователей. Однако после волны критики компания решила временно полностью отключить эту функцию.

Теги:
+3
Комментарии1

Появилась возможность получить доступ к Google AI Plus на 1 год в рамках партнёрской программы Internshala для работы, учебы и других задач.

После регистрации получите БЕСПЛАТНУЮ подписку на Gemini, NotebookLM, Flow и 400 ГБ облачного хранилища.

Что нужно сделать:

  • зайти по адресу https://internshala.com/;

  • создать учётную запись;

  • найти предложение Google AI Plus для аккаунта;

  • нажать на предложение и активировать план;

  • Прикрепить карту. С карты ничего не спишут, а дадут подписку бесплатно на целый год. Изначально акцию сделали для студентов, но пользователи утверждают, что она активируется и на обычных аккаунтах.

Теги:
+3
Комментарии5

Почему дешёвый VPS-сервер может обойтись дорого в продакшене? Тариф в 3–5 долларов в месяц за VPS кажется приятной экономией на старте. Но если тариф выбран только по цене, счёт за простой, срочную миграцию и потерянных клиентов может прийти позже и оказаться выше, чем сэкономленная разница в ценнике.

Что скрывается за низким ценником? За низкой ценой могут стоять оверселлинг, общий диск, ограниченная поддержка и слабые гарантии по SLA. У части провайдеров низкая цена достигается за счёт плотного размещения клиентов на одной ноде: продаётся больше vCPU и RAM, чем физически доступно, в расчёте на то, что нагрузки не совпадут. В результате могут появляться CPU steal time, просадки I/O от соседей по железу и нестабильная производительность общего хранилища. SLA на бюджетном VPS-сервере может отсутствовать или ограничиваться формальным обещанием без понятной компенсации.

Реальные риски в продакшене. Под нагрузкой проблемы проявляются внезапно: API начинает отвечать с задержками, база данных упирается в I/O, сервис падает в самый неподходящий момент. Потеря данных из-за отсутствия бэкапов или срочная миграция перед дедлайном – реальные риски для проектов, которые выбирают инфраструктуру только по цене.

Как считать полную стоимость VPS? Реальная цена – это не только тариф, а TCO: тариф + стоимость инцидентов. Один час простоя интернет-магазина в пиковый сезон легко перекрывает годовую разницу между дешёвым и надёжным VPS. Добавьте часы на диагностику и миграцию, потери из-за недовольных клиентов – и экономия быстро испаряется.

Чек-лист: признаки надёжного VPS:

•        SLA не ниже 99,9%

•        NVMe-хранилище со стабильной производительностью или понятными IOPS-лимитами

•        Современная аппаратная виртуализация, например KVM, и понятная политика изоляции ресурсов

•        Автоматические бэкапы с проверенным восстановлением

•        Поддержка 24/7 с заявленным временем ответа

•        Гарантированная пропускная способность сети

Прежде чем продлевать текущий тариф, проверьте свой VPS по этому чек-листу. Если несколько пунктов вызывают сомнения – стоит пересмотреть выбор сервера для продакшена до первого серьёзного инцидента.

Теги:
+3
Комментарии0

Почему аптайм зависит не только от VPS-провайдера?

Провайдер может обещать 99,9% аптайма VPS, но аптайм продукта и аптайм инфраструктурного узла остаются разными показателями. Когда сервис падает, причина часто находится за пределами зоны ответственности провайдера: в приложении, деплое, базе данных, DNS или внешних API.

Что именно гарантирует VPS-провайдер? SLA VPS-провайдера покрывает доступность физического узла, сетевого канала и питания. Если оборудование работает и сеть доступна, инфраструктурная часть SLA может считаться выполненной. Код, конфигурации, база данных и внешние зависимости остаются в вашей зоне ответственности.

Где на самом деле ломается аптайм? На практике многие простои возникают не из-за сбоев инфраструктуры, а из-за ошибок в коде и операционных процессах. Неудачный деплой, утечка памяти, переполненный диск, истёкший SSL-сертификат, недоступный DNS или упавший сторонний API гасят сервис независимо от стабильности хостинга.

Ошибки на стороне команды. Релиз без стейджинга и механизма отката, отсутствие проверок состояния, ручные правки конфигурации в продакшене: всё это классические источники простоев. Мониторинг, добавленный «потом», не предупреждает о проблеме до того, как её замечают пользователи.

Как повысить реальный аптайм сервиса? Стабильность сервиса на VPS складывается из нескольких пунктов. Автоматические бэкапы и снапшоты упрощают восстановление после сбоя. Проверки состояния и алерты сокращают время обнаружения инцидента. CI/CD-пайплайн с проверками и понятным откатом снижает риск ошибок при деплое.

Чек-лист надёжности:

  • Бэкапы и снапшоты настроены и проверены

  • DNS TTL снижен перед плановыми миграциями

  • SSL-сертификаты обновляются автоматически

  • Есть процедура отката для каждого релиза

  • Мониторинг и алерты подключены до деплоя

Аптайм сервиса на VPS-сервере зависит от инфраструктуры, архитектуры и операционных процессов одновременно. Пересмотрите собственные процессы: деплой, мониторинг, бэкапы и восстановление после сбоев. Если нужен взгляд со стороны, можно начать с аудита инфраструктуры и точек отказа.

Теги:
+3
Комментарии0

Открыли доступ к курсам по ML-системам от основ до продакшна. И да: это бесплатно

Кто-то смотрит на ML как на способ оперативно занять рыночную нишу, не понимая, какой технический фундамент необходим для реализации идеи очередного прорывного продукта. Кто-то запускает идеальный эксперимент в ноутбуке, но выясняется, что он не работает в продакшене. Это две крайности одной и той же проблемы: мало кто понимает, как работают ML-системы от первого винтика данных до последней шестеренки мониторинга. Чтобы глобально исправить это, мы собрали весь свой опыт провайдера облачных и ИИ-решений в линейку курсов Cloud.ru ML System Design и сделали доступ к ней открытым.

Какие курсы есть в линейке? 

  • «Машинное обучение в облаке»⏳15 ч — как использовать облачную инфраструктуру для разработки, обучения и эксплуатации ML-систем.

  • «ML в продакшене»⏳2 ч — база, которую нужно знать, чтобы довести модель от эксперимента до стабильной работы в боевой среде с учетом инфраструктуры, данных и процессов.

  • «Основы ML‑систем и обработки данных» ⏳3 ч — базовое устройство ML-систем, пайплайнов данных и ключевых компонентов end-to-end решения.

  • Training Data⏳3 ч — как собирать, очищать, версионировать и поддерживать обучающие данные без деградации качества.

  • Feature Engineering ⏳4 ч — как проектировать и поддерживать признаки, которые работают не только в обучении, но и в проде.

  • Model Development ⏳3 ч— как разрабатывать модели с учетом требований к качеству, воспроизводимости и дальнейшему деплою.

  • «Офлайн-оценка ML‑модели»⏳3 ч — как корректно валидировать модели до продакшена и не переоценивать их качество.

  • Model Training⏳4 ч — как строить надежные и масштабируемые процессы обучения моделей.

  • Inference⏳4 ч — как организовать инференс (онлайн и батч) с учетом latency, нагрузки и архитектурных ограничений.

  • Model Monitoring⏳3 ч — как отслеживать деградацию моделей, data drift и аномалии в проде.

  • MLOps⏳4 ч — как выстроить процессы, CI/CD и инфраструктуру для жизненного цикла ML-моделей.

  • «Проектирование ML-системы»⏳2 ч — практический кейс для отработки навыков, который поможет персонализировать ленту новостей.

Курсы рассчитаны на менеджеров проектов и продуктов, фронтенд- и бэкенд-разработчиков, продуктовых дизайнеров и дата-сайенс специалистов.

Проходите курс и создавайте зрелые ML-продукты! 

Теги:
+3
Комментарии0
1
23 ...