Обновить

Как будто вчера я писал пост о том, что сделал музыкальный клип с помощью нейронных сетей для генерации видео. Однако, это не единственный способ использования нейронных сетей в монтаже видео.

Я хотел бы рассказать вам о своем приложении с открытым исходным кодом, которое устанавливается на компьютер одним кликом. Оно создано для того, чтобы улучшить жизнь людей, делая процесс создания контента проще и эффективнее. Приложение позволяет проводить видеомонтаж, автоматически удалять текст и объекты из видео, заменять лица на видео фотографиями, синхронизировать речь с движениями губ, а также улучшать качество лица и рисованного видео. Есть также модуль изменения видео: при помощи текста и Stable Diffusion вы описываете, как вы хотели бы изменить видео, а нейронные сети сами воплощают ваши пожелания. Кроме того, приложение предлагает синтез речи и клонирование голоса, но это уже другая история...

P.S. По ссылкам вы найдете статьи, в которых я объясняю, как это сделано, и также видео. Если вам понравилась музыка, вы найдете ее больше на канале. А если вы хотите узнать, о том, что готовится в Wunjo AI v2, тогда для вас блог, где я рассказываю а процессе создания.

Теги:
Всего голосов 2: ↑2 и ↓0+2
Комментарии0

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Qwen3.8-Flash-Next - открытая 125B-модель на архитектуре, которая станет основой Qwen4. По опубликованным Qwen результатам она конкурирует с закрытыми frontier-моделями в задачах программирования, работы с агентами и computer use.

Мы запустили полный checkpoint Qwen/Qwen3.8-Flash-Next на одной RTX 4090. Пиковое потребление VRAM составило 5,95 ГБ, без 4-битной квантизации и дистилляции. Использовался полный checkpoint в bf16, который генерировал обычные токены.

По сравнению с Opus 4.6 Max, согласно собственным данным Qwen:

Как запустить Qwen3.8-Flash-Next 125B на 6 ГБ VRAM

Публикации