Обновить
64K+

Работа с видео *

Все о создании и обработке видео

133,25
Рейтинг
Сначала показывать
Порог рейтинга
Уровень сложности

На заводе камера смотрит на колбу раз в десять минут. И это не поломка

Уровень сложностиПростой
Время на прочтение9 мин
Охват и читатели4.2K

За производством на нефтехимическом заводе следят сотни камер. Они смотрят на конвейеры с продукцией, на колбы с жидкостью, на рабочие зоны, где люди должны быть в касках. Если что-то идёт не так, у системы есть пять секунд, чтобы заметить это и сообщить оператору.

Сама камера только снимает. А замечает проблемы и рассылает уведомления программа, которая обрабатывает видео с камер. Этой программой тогда занимались мы, разработчики. И на заводе нам мало что можно. 

Влезать в оборудование запрещено: производство нефтехимическое, даже датчик не поставишь. Облака тоже нет — серверы стоят в закрытом контуре, без выхода в интернет. Выключить систему на обновление нельзя: производство работает без остановки. А все вычисления идут на обычных процессорах, видеокарт у нас нет. 

Меня зовут Даниил Блинов. Когда мы перестраивали систему, я был техлидом команды видеоаналитики СИБУРа. Сейчас работаю в другой команде. Про то, как мы ускорили обработку видео в 28 раз без видеокарт, я уже рассказывал на Хабре.

Эта статья — про то, как мы перестроили систему видеоаналитики под сотни камер на тех же серверах и без остановки. Глубоко в машинное обучение и компьютерное зрение погружаться не придётся, расскажу простым языком. 

Читать далее

Новости

Путь видео в онлайн-кинотеатрах от «стекла до стекла». Часть третья: хранение и доставка контента с помощью Origin и CDN

Уровень сложностиПростой
Время на прочтение8 мин
Охват и читатели3.9K

Привет, Хабр! Меня зовут Дмитрий Новожилов, я руководитель одного из направлений в онлайн-кинотеатре KION. В прошлый постах рассказал, про попадание и нормализацию контента и про управление им в сердце киносервиса — элементе Middleware. 

В этом посте я перейду к теме прохождения видеопотока: после пакетайзера «кадры» поступают на Origin, откуда и отправляются пользователям с помощью CDN.

Читать далее

Нейросети для нарезки подкастов в 2026 году: девять сервисов и работа с коротким видео

Уровень сложностиПростой
Время на прочтение13 мин
Охват и читатели6.1K

Часовой выпуск подкаста может содержать несколько хороших коротких роликов. Гость объяснил причину технического решения, ведущий разобрал ошибку, участники обсудили спорный подход. Эти эпизоды можно отдельно опубликовать в Shorts, Reels или TikTok. Сначала, однако, нужно найти их в записи и понять, какие из них сохранят смысл без остального разговора.

Поиск фрагментов занимает лишь часть работы. Дальше придётся определить начало и конец, перенести горизонтальное изображение в вертикальный кадр, исправить субтитры и подготовить файл. Сервисы автоматической нарезки собирают эти операции в одном интерфейсе. Они предлагают кандидатов для публикации и инструменты, с помощью которых можно довести клип до готового состояния. При этом короткий ролик должен объяснять тему самостоятельно. Ответ, который понятен участникам часовой беседы, может ничего не говорить зрителю, впервые открывшему клип. Поэтому автоматизация полезна там, где она сокращает поиск и монтаж, а смысл найденного эпизода можно проверить по исходной записи.

В этом обзоре есть шесть инструментов для работы с готовым видео и три сервиса, которые также позволяют создавать ролики по сценарию. Возможности сверены с официальными страницами на 7 октября 2026 года. Здесь нет сравнительных замеров скорости или качества: задача статьи состоит в том, чтобы объяснить различия между рабочими процессами и предложить способ проверки на собственном материале.

Читать далее

Зачем мы совместили съёмку на зелёном фоне, 3D-рендеры и генеративный ИИ в одном видео и что у нас получилось

Уровень сложностиСредний
Время на прочтение5 мин
Охват и читатели6.9K

Использовать возможности нейросетей или организовать традиционную видеосъёмку? Рассказываем, как, получив задачу создать имиджевое видео, мы объединили усилия двух команд, ИИ-инструменты и ручную работу. В итоге инхаус создали трёхминутный фильм — с актёрами и трёхмерной графикой.

Три технологии в одном фильме

Спецэффекты в кино до появления компьютерной графики

Уровень сложностиСредний
Время на прочтение17 мин
Охват и читатели11K

Если вы думаете, что два персонажа, сыгранные одним актером, могли оказаться в одном кадре и даже взаимодействовать лишь после появления компьютерной графики, то глубоко ошибаетесь. Кинематографисты научились создавать совершенно невозможные сцены задолго до того, как цифровые спецэффекты стали нормой. Маски, многократная экспозиция, оптические принтеры, рирпроекция, дорисовки на стекле и еще десятка два технологий, на которых почти сто лет зиждилось кинопроизводство.

Как вообще вырезать актера из фона без компьютера? Почему фон за актерами сначала был синим, а потом вдруг стал зеленым? Что такое оптический принтер и что на нем можно сделать помимо совмещения кадров? И чем на самом деле занимались первые компьютеры на съемках? Давайте узнаем обо всем этом.

Камера, мотор, поехали!

Читать далее

Как узнать длительность видео по ссылке, скачав 7% файла, и почему в заголовке MP4 бывает ноль

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели10K

Пользователь загрузил ролик на 37 мегабайт и получил ответ: «Не удалось определить длительность видео». Ролик был обычный, открывался в любом плеере, ffprobe показывал 18 секунд. В логах ошибок при этом не было вообще. Под катом разбор того, как устроена длительность в MP4, почему в заголовке файла она бывает нулевой и как достать её тремя HTTP-запросами без ffmpeg.

Читать далее

«Не могу ждать»: М.Видео запускает распродажу 10.10 гоночным роликом со своими ИИ-амбассадорами Эм.Ви и Видиком

Уровень сложностиПростой
Время на прочтение2 мин
Охват и читатели5.9K

М.Видео первой запускает большую распродажу, не дожидаясь 11.11 и традиционной ноябрьской «Черной Пятницы». К старту кампании М.Видео представила новый рекламный ролик с амбассадорами Эм.Ви и Видиком в эстетике автомобильных гонок и с отсылками к атмосфере ожидаемой GTA 6.

Читать далее

Как не утопить RTSP в YOLO: real‑time‑конвейер на C++20, Clang и ONNX Runtime

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели5K

YOLO обрабатывает кадр дольше, чем камера формирует следующий. Если построить видеосервер как последовательность read → motion → YOLO → encode, тяжёлая модель остановит чтение RTSP, очередь начнёт расти, а пользователь увидит прошлое вместо прямого эфира.

В статье разбираю real‑time‑конвейер своего C++20-сервера: постоянные workers, слоты последнего значения, std::jthread, stop_token, защита от устаревших результатов и итоги 16-часового теста на реальной RTSP‑камере.

Читать далее

Рендерим обучающие 3D‑ролики кодом на React и Three.js вместо съёмок и AI‑видео

Уровень сложностиПростой
Время на прочтение6 мин
Охват и читатели7.6K

Я делаю мобильное образовательное приложение. В какой‑то момент понадобилось объяснять пользователям сложные сценарии, где объекты двигаются по строгим формальным правилам, и объяснять не текстом, а видео. Любая неточная траектория или неверно анимированное действие на видео закладывает неверный паттерн. Я собрал для этого конвейер на Remotion и React Three Fiber.

Читать далее

ИИ-слоп: не всё так плохо?

Уровень сложностиПростой
Время на прочтение10 мин
Охват и читатели10K

Открываешь ленту, попадается интересное видео, и ты залипаешь.
На середине замечаешь, что что-то не так. Голос слишком ровный, картинка подозрительно гладкая, сюжет местами тянется. Потом доходит, что ролик целиком сделан нейросетью. И всё равно не выключаешь.

Обычно ИИ-слоп просто ругают и пролистывают. Мол, дешёвая штамповка, никакой души, только просмотры собрать. Но если ролик тебя увлёк, он правда стал хуже оттого, что его сделал ИИ? Что именно мы имеем в виду, когда называем контент слопом? Пустой сюжет, отсутствие человеческого труда или то, что ленты забиваются похожими видео? Тут уже хочется поговорить не только о качестве, но и о том, как мы вообще оцениваем контент, созданный нейросетью.

В этой статье разберём, как за пару лет мы прошли путь от смешного Уилла Смита со спагетти до видео, которое практически никак не отличить от настоящего. Посмотрим, почему ИИ-контент появляется в постах, роликах и музыке, чем затягивают китайские ИИ-сериалы и почему бизнесу нравится ИИ-слоп.

«Читать далее»

Zynq 7000. Камера MIPI‑CSI-2 и вывод видеопотока через HDMI и Ethernet UDP. Часть 2

Уровень сложностиПростой
Время на прочтение82 мин
Охват и читатели7.2K

Продолжаем рассмотрение темы вывода изображения взятого с камеры на базе сенсора OV5647 (CSI-2, RAW10). В первой части мы разобрали подключение камеры к Zynq-7020, подготовили проект в Vivado и получили живое изображение на HDMI, используя битстрим производителя и отладку через JTAG. Продолжение начинается с главы 22: переходим к собственному битстриму и разбираемся с ошибками, которые проявились после пересборки.

Начнем с искажений изображения: входных задержек MIPI, неверной конфигурации DDR, перестановки цветовых компонент и разрывов кадра. Затем добавим аппаратное сжатие JPEG, проверим обвязку энкодера в симуляции и настроим загрузку Linux через Buildroot. Завершим проект передачей MJPEG по HTTP с возможностью перепаковки в RTP/UDP на хосте. По ходу разберем конкретные симптомы, проверки и исправления, а в конце измерим производительность всего тракта: от примерно 30,6 кадра в секунду на приеме до 23 кадров в сетевом потоке.

Всем заинтересованным - добро пожаловать под кат!

Читать далее

Видеоплееры живут в 2012 году, а мы — нет

Уровень сложностиПростой
Время на прочтение18 мин
Охват и читатели13K

Все мы любим VLC. Он открывает что угодно, работает на всём, не просит денег и не спрашивает, кто ты такой. IINA на маке выглядит как нормальное приложение, а не как диалог из нулевых. mpv вообще эталон: лучшая картинка, скрипты, конфиг под любую паранойю. Это отличные плееры, я пользовался всеми тремя годами и не собираюсь объяснять, что их авторы что-то делают не так.

Но однажды я поймал себя на мысли: 2026 год, вокруг десятки приложений, отполированных до состояния, когда интерфейса просто не замечаешь: он не мешает, он угадывает, он не заставляет вспоминать, где лежит нужная галочка. И ни одного такого видеоплеера. Хороших видеоплееров не существовало — не в смысле «не умеют открыть файл», а в смысле, в котором мы говорим «хорошее приложение» про всё остальное на своём компьютере. Поэтому я сделал свой.

Он называется Frame Player, он бесплатный и с открытым кодом, Windows и macOS. Дальше — список того, что меня в плеерах раздражало, и что с каждым пунктом в итоге получилось сделать.

Читать далее

Записки из подполья незаконного архивирования фильмов

Уровень сложностиПростой
Время на прочтение12 мин
Охват и читатели92K

«Люди, видоизменяющие или уничтожающие художественные работы и наше культурное наследие ради прибылей или демонстрации власти — это варвары, и если законы США продолжат оправдывать такое поведение, то мы точно войдём в историю, как варварское общество.»

— Джордж Лукас, 1988 год

«Для меня её [оригинальной трилогии «Звёздных войн»] больше не существует. Я задумывал этот фильм именно так, и мне жаль, что вы увидели половину целого фильма и полюбили его.»

— Джордж Лукас, 2004 год

Ванкувер, 2011 год: мы с моей соседкой Виллой Росс сидим в одной из характерно стерильных монтажных студий Университета Саймона Фрейзера и уже не знаем, что делать: мы провели все выходные, ваяя из трёх разных копий вестерна Серджо Леоне 1966 года «Хороший, плохой, злой» одну версию — причём все три копии были незаконными рипами. В начале 2000-х этот фильм пал жертвой «реставрации», выполненной компанией MGM: вырезанные Серджо Леоне сцены были возвращены, увеличив время англоязычной версии с 161 до 179 минут; Клинт Иствуд и Илай Уоллак дублировали недостающие диалоги, а место умершего к тому времени Ли Ван Клифа занял похожий на него голосом дублёр. Монофоническая дорожка была переработана в многоканальный звук с неприятно современными звуками выстрелов. Почти десяток лет эта «дополненная» лента оставалась единственной продаваемой версией фильма; подобное очень часто происходит в эпоху ревизионистских студийных реставраций.

Наша цель была простой: спасти фильм от этой вивисекции. Мы планировали соединить звук уже не издававшегося DVD 1998 года (приблизительно похожий на звук международного релиза 1967 года) с видео из недавно привезённого Blu-ray итальянской версии. После того, как мы успешно преодолели многочисленные подводные камни, связанные с риппингом домашних видеозаписей конца 2000-х, наши надежды рухнули из-за катастрофического открытия: итальянская версия оказалась ещё сильнее отличающейся от международной, чем расширенная версия: печально известная сцена пытки была полностью перестроена, а у некоторых кадров отсутствовали начало и конец. Мы почти на десяток лет отказались от этой затеи.

Читать далее

Ближайшие события

Что такое конторка, зачем нужен калоидный ускоритель и как ООО «Слоп» отражает типичные боли наёмных работников

Время на прочтение5 мин
Охват и читатели5.4K

А ещё чем отличается годный нейроконтент от слопа и как сгенерировать себя в мире конторки

Сгенерированный нейросетями сериал про безымянный офис ООО «Слоп» набрал 28,5 тысячи подписчиков всего на 28 роликах, а отдельные видео набирают до 800 тысяч просмотров. Сотрудники этой конторы «бередят бурмалду», получают премию кукишами и боятся попасться на глаза Куканоиду. Разбираемся, откуда в этом абсурде взялся свой язык и почему мы так легко узнаём в этих героях себя.

Читать далее

Синхронизация камер по звуку без хлопушки: что я понял, пока делал плагин для Premiere Pro с нейросетью

Уровень сложностиСредний
Время на прочтение10 мин
Охват и читатели5.6K

Я монтажер, не программист. За месяц вместе с нейросетью сделал плагин для Premiere Pro: он синхронизирует камеры с рекордером по звуку, режет паузы и дубли и собирает секвенцию. Историю я уже рассказывал на vc.ru, а здесь будут внутренности: как найти сдвиг между файлами, почему одного порога корреляции мало, как отличить готовый ролик от исходника и почему тесты на каждый релиз оказались важнее любого кода.

Сразу оговорюсь: код писала нейросеть под мою постановку, а я проверял на своих проектах. Поэтому это не статья «смотрите, как красиво». Это статья про задачи, которые пришлось решить, грабли, на которые наступил, и числа, которые пришлось намерить.

Читать далее

Flow Matching: обучение и дистилляция

Уровень сложностиСложный
Время на прочтение29 мин
Охват и читатели6.5K

Flow Matching — один из главных подходов к генерации изображений. Его используют, например, Stable Diffusion 3.5 и FLUX.2.

Но есть нюанс: чтобы сгенерировать одну картинку, модель приходится запускать десятки, а иногда и сотни раз.

В новой статье разбираемся, как устроен Flow Matching и как дистиллировать обученную модель в быстрый одношаговый генератор 🏎

Разберём, что такое Flow Matching и при чём здесь векторные поля 🌾, почему генерация требует множества шагов и чем это мешает, а также как устроена дистилляция в одношаговый генератор — и при чём тут игра двух моделей 🎲.

P. S. Будет много интуиции, математики и практических деталей обучения 🧠

Читать далее

Как я запустил Bad Apple с частотой 20 fps на E‑Ink дисплее за $71

Уровень сложностиСложный
Время на прочтение14 мин
Охват и читатели17K

Мне удалось запустить полноценное чёрно-белое видео на стоковой плате ESP32-S3 с экраном на электронных чернилах: никакой ПЛИС и никакого ПК — панель управляется напрямую по параллельной шине. В статье я подробно расскажу, как работает этот драйвер. Если коротко, то в нём используется векторный блок, принимающий по 64 пикселя за раз; управляющие сигналы (waveforms), которые хранятся в регистрах, а не в таблицах, и дельта-движок, который обрабатывает только изменения. При этом точность всей системы контролировалась с помощью планшетного сканера.

Читать далее

Как нейросеть переводит видео. Часть 1: Whisper врёт, и мы это знаем

Уровень сложностиСредний
Время на прочтение8 мин
Охват и читатели4.9K

Я один пишу сервис дубляжа видео с 2022 года, когда OpenAI выложил Whisper и мне показалось, что дело на месяц. В 2026-м через конвейер прошло 9 203 задачи, и он ломается в тех же местах, что и в первый. Первая часть из трёх: как звук становится текстом с таймкодами и спикерами. Три типа галлюцинаций Whisper и ловушки на каждый с кодом, почему мы выбрасываем его сегменты и собираем предложения сами, каскад на своей видеокарте с запасными выходами, хинди, который молча терял по 15 секунд речи, и честное ограничение: двое говорящих одновременно не бывает.

Читать далее

Разработка платформы координации ПСР во время реальной спасательной операции

Уровень сложностиПростой
Время на прочтение24 мин
Охват и читатели6.9K

12 августа в Алайском районе начали искать пропавших альпинистов. Дрон снимал склоны, материал копился часами, и команда ПСР разбирала его вручную, своими средствами.

15 августа я отдал организаторам платформу, где всё собрано в одном месте. Следующие семь дней я правил платформу прямо по ходу работы волонтёров. Дальше — про эти правки и про то, как всё уместилось в один ноутбук с домашним интернетом и забитым диском.

Читать далее

12 ГБ VRAM и WAN 2.2 I2V‑A14B: как заставить RX6700XT генерировать видео неограниченной длины

Уровень сложностиСложный
Время на прочтение4 мин
Охват и читатели8.3K

12 ГБ VRAM, AMD, WAN 2.2 I2V‑A14B. Начал решать проблемы с генерацией видео и ограничениями железа — в итоге собрал пайплайн, который генерирует видео неограниченной длины, без швов. Вот как это работает и что пришлось принять как данность.

Читать далее
1
23 ...