Двенадцать нейросетей для видео прогнали на одном промпте: 8 секунд, 720p, по одному прогону (одной генерации) на модель. Первым по сумме баллов вышел Luma Ray 3.14: 9,1 из 10, две минуты, 5 токенов, дешевле всех в списке. Лучшую картинку показала Seedance 2.5, и она же самая дорогая: 138,7 токена, в 27 раз дороже лидера.

Проверено 9 октября 2026 года. Версии всех моделей указаны по состоянию на эту дату.

В марте 2026 года OpenAI закрыла Sora. Модель, с которой год назад сравнивали всех остальных. В этом списке её нет, и место Sora никто не занял целиком: его поделили между собой двенадцать генераторов ниже.

Карточки моделей похожи друг на друга до скуки: 1080p, звук, 10-15 секунд, референсные изображения (образцы, по которым модель держит персонажа или стиль). Обычные рейтинги нейросетей для видео сравнивают именно эти характеристики, и по ним модель не выбирается: у половины списка цифры совпадают, а разница в разрешении и длине сцены перекрывает разницу в том, как модель работает. Увидеть её можно только тогда, когда всем дают одну и ту же задачу.

Так что задача была одна: двенадцать моделей, один промпт, одно разрешение и ни одной подсказки о том, как каждая из них себя поведёт.


Дальше: как считали, полная таблица с баллами и разбор по каждой модели.

Короткий ответ

  • По сумме баллов: Luma Ray 3.14, 9,1 из 10, две минуты, 5 токенов. Дешевле всех в списке, но ролик требует цветокоррекции, а звука и референса персонажа у модели нет.

  • По картинке: Seedance 2.5. Единственная сделала задачу без скидок и самая дорогая в тесте: 138,7 токена и шесть минут.

  • Быстро и дёшево: Gemini Omni Flash 1.1, 10,5 токена и минута, при потолке 720p и десяти секундах.

  • Для эпизода с несколькими планами и репликами: Kling 3.0, от 3 до 15 секунд, звук и синхронизация губ, без провалов.

  • Хуже всех: Wan 2.7, 3,2 из 10, десять минут на генерацию и проигрыш по всем трём частям оценки.

Как тестировали нейросети для видео: один промпт, 8 секунд, 720p

Один текстовый промпт на двенадцать моделей. 8 секунд, 16:9 и 720p, чтобы все оказались в одинаковых условиях.

720p выбран намеренно, хотя половина моделей умеет больше. Сравнивать 4K против 720p бессмысленно, разница в разрешении перекроет разницу в качестве работы. Все двенадцать снимали на одном и том же разрешении.

Почему восемь секунд? Veo 3.1 за один проход больше не делает, а ставить 8 секунд рядом с 15 нечестно.

Смотрели, держится ли объект от первого кадра до последнего и как ведут себя огонь, пар, дым и вода. Проверяли, сделала ли модель то, что написано в промпте, и считали время с расходом.

Звук оценивали отдельно. У Runway и Luma своего звука нет, и снимать с них за это баллы в общей оценке странно.

Grok Imagine 1.5 Preview работает только от стартового кадра, текстом его не запустить. Та же история с Runway Gen-4 Turbo. Для них сделали исключение: стартовый кадр сгенерировали в их собственных моделях для изображений, в Grok и Runway Frames, и уже от изображения получили видео. Прогон остался один, как у всех.

Каждую модель запускали по разу. В реальности такое редко даёт идеальный результат, обычно нужны попытки. Тем интереснее: справятся ли модели с одной? Второй попытки не делали никому, в том числе Veo 3.1, у которой единственный прогон вышел самым слабым в верхней половине списка.

По ходу теста все модели выдали результат без ошибок и сбоев, а на генерацию потребовалось до 1 часа. Почти всё это время ушло на ожидание, а не на работу: у Gemini на ролик уходит минута, у Wan десять.

Все двенадцать прогонов шли через SYNTX.AI. Одна среда, один аккаунт, один формат учёта токенов. Токен у каждого сервиса считается по-своему, и расход между разными платформами складывать нельзя. Здесь единица учёта одна на весь тест, поэтому цифры сопоставимы между собой.

Промпт для теста: одна задача на двенадцать моделей

A street food vendor at a rainy night market tosses noodles in a wok, flames leap up, steam rises into neon light, raindrops hit the awning, camera slowly pushes in from a medium shot to a close-up of his hands, shot on 35mm film, shallow depth of field

В кадре за восемь секунд должны успеть появиться огонь, пар, дождь, неон, руки крупным планом и движение камеры. На руках и лапше модели ломаются чаще всего, а дым и пар проверяют, понимает ли модель физику, или просто рисует красивые пятна.

Промпт собран как ловушка. Скучная задача не показала бы разницы, все двенадцать выдали бы примерно одно и то же.

Все двенадцать роликов рядом:

Все модели, 8 с, 720p, тот же промпт
Все модели, 8 с, 720p, тот же промпт

Как считали оценки: качество 80%, скорость и цена по 10%

Итог собран из трёх частей: качество картинки и попадание в промпт (80%), скорость генерации (10%), экономия по токенам (10%).

Качество весит больше всего, потому что ролик заказывают ради картинки. Скорость и цена её только правят: ждать шесть минут неприятно, но не так неприятно, как получить брак за одну.

Качество ставили глазами, по десятибалльной. Скорость и экономию посчитали по прогону.

Скорость: 1 минута это 10 баллов, 10 минут это 1 балл, шкала линейная между ними.

Экономия: 5 токенов это 10 баллов, 138,7 токена это 1 балл. Токены считаем не абсолютной цифрой, а по разбросу внутри списка, иначе цифра ничего не говорит.

Модель

Время

Токены

Скорость

Экономия

Качество

Итог

Luma Ray 3.14

2 мин

5

9

10,0

9

9,1

Seedance 2.5

6 мин

138,7

5

1,0

10

8,6

FLUX 3 Video

2 мин

80

9

5,0

9

8,6

Kling 3.0

3 мин

48

8

7,1

8

7,9

Gemini Omni Flash 1.1

1 мин

10,5

10

9,6

7

7,6

Grok Imagine 1.5 Preview

1 мин

44

10

7,4

7

7,3

Veo 3.1

5 мин

119

6

2,3

8

7,2

Hailuo 3.0 (MiniMax H3)

3 мин

48

8

7,1

6

6,3

Seedance 2.0

3 мин

30,8

8

8,3

5

5,6

Runway Gen-4.5

4 мин

28

7

8,5

5

5,5

Runway Gen-4 Turbo

2 мин

28

9

8,5

4

5,0

Wan 2.7

10 мин

48

1

7,1

3

3,2

Всего на двенадцать роликов ушло 628 токенов.

Seedance 2.5 и FLUX 3 Video набрали одинаковые 8,6: у Seedance на балл выше картинка, а FLUX быстрее и дешевле, и эти преимущества гасят друг друга.

Первая пятёрка держится на качестве, а не на цене. Три из пяти её участников дорогие: Seedance 2.5 на 138,7 токена, FLUX на 80, Kling на 48. Две дешёвые, Luma и Gemini.

И места сильно зависят от того, какой из трёх частей дать больший вес. Ниже тот же прогон, посчитанный по 60 / 20 / 20.

Модель

80 / 10 / 10

60 / 20 / 20

Сдвиг

Luma Ray 3.14

1

1

0

Seedance 2.5

2

6

+4

FLUX 3 Video

3

2

−1

Kling 3.0

4

4

0

Gemini Omni Flash 1.1

5

3

−2

Grok Imagine 1.5 Preview

6

5

−1

Veo 3.1

7

8

+1

Hailuo 3.0 (MiniMax H3)

8

7

−1

Seedance 2.0

9

9

0

Runway Gen-4.5

10

10

0

Runway Gen-4 Turbo

11

11

0

Wan 2.7

12

12

0

Больше всех от смены веса страдает Seedance 2.5: четыре позиции. У остальных сдвиг не больше двух. Один и тот же прогон, одни и те же оценки, разный ответ на вопрос «что важнее».

Рейтинг нейросетей для видео: 12 моделей на одном промпте

Порядок собран из оценок выше: качество 80%, скорость 10%, экономия 10%. В подписях к роликам указаны модель, длина, разрешение и время генерации, чтобы их можно было сопоставить с таблицей.

1. Luma Ray 3.14: 9,1

Luma Ray 3.14, 8 с, 720p, генерация 2 мин
Luma Ray 3.14, 8 с, 720p, генерация 2 мин
Luma Ray 3.14 - 3 кадра (начало, середина, конец)
Luma Ray 3.14 - 3 кадра (начало, середина, конец)

Вышла 26 января 2026 года. Нативный 1080p, а на 720p в 4 раза быстрее и в 3 раза дешевле Ray 3.0.

Картинка и физика в порядке, ролик требует цветокоррекции. Расход 5 токенов. Лучший результат в списке, в 27 раз дешевле Seedance 2.5.

Главная фишка нужна не всем. Это вывод в формате EXR (OpenEXR: формат с расширенным динамическим диапазоном, HDR): готовый кадр можно нести колористу и красить без потерь. Для колориста это очень много, а тому, кто делает ролик для Reels, это ничего не даёт.

Звука нет. Референса персонажа тоже нет, то есть задать героя картинкой и удержать его между генерациями не получится.

Единственная модель, которая выиграла в обоих расчётах. Она сняла почти как лидер, а стоила копейки, и при любом весе оценки это работает в её пользу.

2. Seedance 2.5: 8,6

Seedance 2.5, 8 с, 720p, генерация 6 мин
Seedance 2.5, 8 с, 720p, генерация 6 мин
Seedance 2.5 - 3 кадра (начало, середина, конец)
Seedance 2.5 - 3 кадра (начало, середина, конец)

ByteDance выпустила её 31 июля 2026 года, и главная цифра у неё 30.

Тридцать секунд за проход, без склеек. У остальных моделей из списка потолок от 8 до 20 секунд. В запрос можно загрузить до 50 референсов: персонажей, локации, аудио. Если в готовом ролике сломался один кадр, его перерисовывают отдельно, а не генерируют всё заново.

Лучший результат теста по картинке. Десять баллов, придраться не к чему: огонь, пар, дым, руки, фактура. Из всех моделей здесь она одна сделала то, что просили, и не потребовала скидок.

Второе место при 6 минутах и 138,7 токена. Самый дорогой прогон в тесте. Если роликов будет серия, считать придётся каждый. Если это один ролик, на который не жалко денег, конкурентов у неё нет.

3. FLUX 3 Video: 8,6

FLUX 3 Video, 8 с, 720p, генерация 2 мин
FLUX 3 Video, 8 с, 720p, генерация 2 мин
FLUX 3 Video - 3 кадра (начало, середина, конец)
FLUX 3 Video - 3 кадра (начало, середина, конец)

Картинки, видео и звук FLUX 3 учила вместе, в одной архитектуре. До 20 секунд, Full HD, 24 кадра в секунду, звук.

Начать и закончить ролик она может на заданных кадрах, а уже готовое видео умеет продолжить.

Картинка, движения и физика в порядке. Балл сняли за одно: вместо наезда камеры модель переключилась на крупный план рук. Формально она сделала то, что просили, но сделала это монтажной склейкой, а не движением. Заметит такое только тот, кто смотрит ролик рядом с промптом.

80 токенов. Третья по расходу после Seedance 2.5 и Veo 3.1. От второго места её отделяют тысячные доли балла, и разница эта не в её пользу, а в пользу Seedance. Брать её стоит, когда нужен ровно один хороший ролик без раскадровки и дешевле Seedance.

4. Kling 3.0: 7,9

Kling 3.0, 8 с, 720p, генерация 3 мин
Kling 3.0, 8 с, 720p, генерация 3 мин
Kling 3.0 - 3 кадра (начало, середина, конец)
Kling 3.0 - 3 кадра (начало, середина, конец)

Veo снимает кадр. Kling снимает эпизод.

Kuaishou сделала ставку на раскадровку: от 3 до 15 секунд, несколько планов в одной генерации, звук и синхронизация губ сразу. Если в промпте три действия, модель раскладывает их по планам, а не сваливает в один.

Восемь баллов из десяти и ни одного провала. Три минуты, 48 токенов. Такой ролик можно ставить в серию, не пересматривая каждый.

Лучшая модель списка по соотношению качества и предсказуемости, если вам не нужны длинные сцены.

5. Gemini Omni Flash 1.1: 7,6

Gemini Omni Flash 1.1, 8 с, 720p, генерация 1 мин
Gemini Omni Flash 1.1, 8 с, 720p, генерация 1 мин
Gemini Omni Flash 1.1 - 3 кадра (начало, середина, конец)
Gemini Omni Flash 1.1 - 3 кадра (начало, середина, конец)

В списке она значится как Google Omni Flash 1.1, официально это Gemini Omni Flash. Семейство Omni Google показала на I/O 2026.

Сильная сторона не картинка. Ролик можно править прямо в диалоге: «убери машину», «пусть будет вечер». На вход она принимает текст, изображения, видео и аудио, то есть ролик можно переделать, не запуская генерацию заново.

Минута генерации и 10,5 токена. Второе место по экономии.

За эти деньги она справилась отлично. Единственный вопрос к размерам лапши, они слегка плавают. Картинку она отдаёт не как Veo и не как Seedance, но и стоит в десять раз меньше.

При весе на качестве она опускается с третьего места на пятое. Это цена её компромисса: быстрая и дешёвая, но не лучшая по картинке.

6. Grok Imagine 1.5 Preview: 7,3

Grok Imagine 1.5 Preview, 8 с, 720p, генерация 1 мин, стартовый кадр сгенерирован в Grok
Grok Imagine 1.5 Preview, 8 с, 720p, генерация 1 мин, стартовый кадр сгенерирован в Grok
Grok Imagine 1.5 Preview - 3 кадра (начало, середина, конец)
Grok Imagine 1.5 Preview - 3 кадра (начало, середина, конец)

xAI выпустила превью 30 мая 2026 года. Модель берёт стартовый кадр и описание движения. Звук, музыку и диалог с синхронизацией губ она делает за один проход. До 15 секунд, 480p или 720p.

Текст ей дать нельзя, как и Runway Gen-4 Turbo, поэтому кадр мы нарисовали ей в том же Grok. Со стартовой картинкой она справилась, включая дым от готовки. Минута и 44 токена.

Для своей цены этого достаточно. Здесь есть оговорка: половину работы модель получает готовой, и сравнивать её в лоб с текстовыми генераторами не совсем честно.

7. Veo 3.1: 7,2

Veo 3.1, 8 с, 720p, генерация 5 мин
Veo 3.1, 8 с, 720p, генерация 5 мин
Veo 3.1 - 3 кадра (начало, середина, конец)
Veo 3.1 - 3 кадра (начало, середина, конец)

Veo 3.1 вышла в октябре 2025 года. До 4K, звук с диалогами, до четырёх референсных изображений на генерацию.

У неё единственный прогон оказался самым слабым в дорогой половине списка: картинка на восемь баллов, но в промпт ролик попал. Мы отнёсли его в раздел неудачных попыток. Второй попытки мы не делали никому, поэтому в рейтинге стоит то, что вышло с первого раза.

По картинке она не уступает лидерам, и при второй попытке вполне могла бы побороться за верх таблицы. Но рейтинг построен на одном прогоне на модель, и здесь у неё седьмое место, а не первое. Пять минут ожидания и 119 токенов, немногим меньше, чем у Seedance 2.5, съедают всю разницу.

Вопрос не в том, умеет ли она снимать, а в том, сколько дублей уйдёт на нормальный кадр. От Grok Imagine её отделяет одна десятая балла. Формально седьмое место, по факту они с Grok ровесники в таблице.

Плюс потолок в восемь секунд за проход. Длиннее получается только продлением по кускам, и стыки потом придётся проверять глазами.

8. Hailuo 3.0 (MiniMax H3): 6,3

Hailuo 3.0, 8 с, 720p, генерация 3 мин
Hailuo 3.0, 8 с, 720p, генерация 3 мин
Hailuo 3.0 - 3 кадра (начало, середина, конец)
Hailuo 3.0 - 3 кадра (начало, середина, конец)

Официальное название у неё MiniMax H3, а в народе её называют Hailuo 3.0, по имени приложения. Вышла 31 июля 2026 года, в один день с Seedance 2.5, так что сравнивать их будут ещё долго.

До 15 секунд, до 2K, 24 кадра в секунду, стереозвук. Диалоги с синхронизацией губ на 11 языках.

Картинка и движения адекватные, три минуты и 48 токенов, столько же, сколько у Kling. Вопросы к физике: огонь и лапша ведут себя как-то не так. Не катастрофа, но именно на такой задаче это видно.

Два одинаковых результата по расходу разводятся качеством. Здесь 6 против 8, и в обоих расчётах Kling выше. Она нужна ради дублей на других языках, где Kling так не умеет.

9. Seedance 2.0: 5,6

Seedance 2.0, 8 с, 720p, генерация 3 мин
Seedance 2.0, 8 с, 720p, генерация 3 мин
Seedance 2.0 - 3 кадра (начало, середина, конец)
Seedance 2.0 - 3 кадра (начало, середина, конец)

Утешительным призом её не назовёшь. Seedance 2.0 возглавляла лидерборд Artificial Analysis, публичный рейтинг моделей по слепым сравнениям. От 1 до 15 секунд, звук генерирует сама.

Зачем она, если есть 2.5? Ради цены. Три минуты и 30,8 токена против шести минут и 138,7 у новой версии. Разница в четыре с половиной раза.

Картинка адекватная, а вот движения и физика под вопросом. Хуже всего то, что предметы пропадают. Лопатка входит в вок и не возвращается.

10. Runway Gen-4.5: 5,5

Runway Gen-4.5, 8 с, 720p, генерация 4 мин
Runway Gen-4.5, 8 с, 720p, генерация 4 мин
Runway Gen-4.5 - 3 кадра (начало, середина, конец)
Runway Gen-4.5 - 3 кадра (начало, середина, конец)

В 2026 году Runway продаёт не модель. Он продаёт мастерскую вокруг неё.

Gen-4.5 вышла 1 декабря 2025 года. 720p, 5 или 10 секунд. Своего звука нет, его добавляют через интеграцию с ElevenLabs или отдельную функцию Lip Sync (синхронизацию движения губ с записанной дорожкой).

Зато есть редактор, апскейл (увеличение разрешения готового ролика) и экспорт в ProRes 4444. Если ролик потом пойдёт в монтажку, это весит больше, чем лишнее разрешение.

Четыре минуты и 28 токенов, расход скромный. Проблема в другом: вопросы и к картинке, и к движениям, и к физике. Пять баллов за это. Мастерская вокруг сильная, а внутри неё модель прошлого поколения.

11. Runway Gen-4 Turbo: 5,0

Runway Gen-4 Turbo, 8 с, 720p, генерация 2 мин, стартовый кадр сгенерирован в Runway Frames
Runway Gen-4 Turbo, 8 с, 720p, генерация 2 мин, стартовый кадр сгенерирован в Runway Frames
Runway Gen-4 Turbo - 3 кадра (начало, середина, конец)
Runway Gen-4 Turbo - 3 кадра (начало, середина, конец)

Gen-4 вышла весной 2025 года, и главным в ней был персонаж, который не меняется от кадра к кадру по одному референсу. Тогда это было событием. Сейчас то же самое умеют почти все модели выше.

Turbo поставили в список ради сравнения с прошлым поколением. 28 токенов, столько же, сколько у Gen-4.5, но в 2 раза быстрее. На скорости все преимущества и заканчиваются.

Картинка лучше, чем у Wan. Физика и движения слабые. Четыре балла. Брать его смысла почти нет: за те же 28 токенов Gen-4.5 снимает лучше.

От Gen-4.5 его отделяют полбалла. При весе на картинке разрыв между ними виден отчётливее, чем при весе на цене.

12. Wan 2.7: 3,2

Wan 2.7, 8 с, 720p, генерация 10 мин
Wan 2.7, 8 с, 720p, генерация 10 мин
Wan 2.7 - 3 кадра (начало, середина, конец)
Wan 2.7 - 3 кадра (начало, середина, конец)

Модель Alibaba. Можно задать первый и последний кадр, собрать видео по сетке из девяти картинок и править готовый ролик текстовыми командами.

Пластиковая картинка, три балла из десяти. Движения и физика неестественные. Единственная модель, которая проиграла и по качеству, и по скорости, и её не спасает даже вес, считающий цену: при 60% на картинку она всё равно последняя.

Десять минут при 48 токенах. По расходу столько же, сколько у Kling и Hailuo, а ждать более чем в три раза дольше. Десять минут на ролик, который всё равно не пригодится.

Сводная таблица

Модель

Длина за проход

Максимум модели

Свой звук

Токены

Качество

Итог

Luma Ray 3.14

5 или 10 с

1080p

нет

5

9

9,1

Seedance 2.5

до 30 с

1080p

да

138,7

10

8,6

FLUX 3 Video

до 20 с

1080p

да

80

9

8,6

Kling 3.0

3-15 с

4K

да

48

8

7,9

Gemini Omni Flash 1.1

4-10 с

4K

да

10,5

7

7,6

Grok Imagine 1.5 Preview

до 15 с

720p

да

44

7

7,3

Veo 3.1

8 с

4K

да

119

8

7,2

Hailuo 3.0 (MiniMax H3)

до 15 с

2K

да, стерео

48

6

6,3

Seedance 2.0

до 15 с

4K

да

30,8

5

5,6

Runway Gen-4.5

5 или 10 с

720p

нет

28

5

5,5

Runway Gen-4 Turbo

5 или 10 с

720p

нет

28

4

5,0

Wan 2.7

до 15 с

1080p

да

48

3

3,2

В колонке «Максимум модели» стоит то, что модель умеет вообще. Тестировали все на 720p.

Как выбрать под свою задачу

Задача решается таблицей, а не «лучшей моделью вообще»: у каждой из первых пяти своя ниша, и они почти не пересекаются.

Если нужно

Берите

На что смотреть

Дешёвый ролик на 8 секунд, потоком

Luma Ray 3.14

цвет придётся править, звука нет

Один кадр без компромиссов, деньги не важны

Seedance 2.5

138,7 токена и шесть минут за прогон

Дешевле Seedance, но так же красиво

FLUX 3 Video

камеру может подменить склейкой

Эпизод с планами и репликами

Kling 3.0

длиннее 15 секунд не снимет

Считают каждый токен

Gemini Omni Flash 1.1

потолок 4K и 10 секунд, правки в диалоге

Оживить готовую фотографию со звуком

Grok Imagine 1.5 Preview

текстом не запускается, нужен стартовый кадр

Если задача не попадает ни в одну строку, ориентируйтесь на три цифры из таблицы: время генерации, расход и длину сцены за проход. Разница в картинке между первым и пятым местом меньше, чем разница в 27 раз по расходу между первым и вторым.

Что показал тест

Вес оценки решает больше, чем сами оценки. Seedance 2.5 с лучшей картинкой теста была шестой при весе 60% на качество и стала второй при 80%. Gemini Omni Flash 1.1 опустилась с третьего места на пятое. Спорить о том, какая модель лучше, бессмысленно, пока не договорились, что считаем важным.

Тот же эффект виден на Veo 3.1. По картинке у неё восемь баллов: столько же, сколько у Kling, и на балл меньше, чем у FLUX. Но 119 токенов и пять минут держат её на седьмом месте, и даже при весе 60% на качество она не поднимается. Дорогие секунды тянут среднее вниз сильнее, чем помогает качество, даже когда качество признано высоким.

Тревога за промпт была ложной. Мы ждали, что задача окажется слишком сложной и развалится у большинства: руки, лапша, дым и наезд камеры одновременно. Развалилась она у пятерых из двенадцати: четверо внизу таблицы и единственный прогон Veo 3.1, где картинка вышла на восемь баллов, что было бы отличным результатом для других моделей. Верх списка (Luma, FLUX, Kling, Gemini и Grok) отработал огонь, пар, дым и наезд камеры спокойно, а Seedance 2.5 прошла тест идеально.

Значит, выбирать между моделями стоит не по тому, справятся ли они вообще, а по цене, скорости и длине сцены. Разница в картинке между первым и пятым местом есть, но она меньше, чем разница в 27 раз по расходу между первым и вторым.

Ограничения теста

Здесь то, что рейтинг не показывает, и границы, за которые его выводы не выходят.

  • Один прогон на модель. Второй попытки не делали никому, включая Veo 3.1, у которой вышел не лучший результат для её возможностей. В реальной работе модель обычно запускают несколько раз.

  • Слабое место одного прогона. Один результат ничего не говорит о стабильности: неизвестно, повторит ли модель удачу со второй попытки. При втором дубле Veo 3.1 могла бы побороться за верх таблицы, но рейтинг считают по одному прогону, и он у всех одинаковый.

  • 720p. Половина моделей умеет больше, и про 4K, 2K или 1080p здесь ничего не сказано: разрешение измерялось одинаковое, чтобы разница в нём не перекрыла разницу в работе. Поведение моделей на своём максимуме не проверялось.

  • Восемь секунд. Потолок выбран по самой короткой модели списка. Всё, что модели умеют на 15-30 секундах, в тесте не видно.

  • Звук вне оценки. Он есть у большинства, но не у всех, поэтому в общий балл не вошёл. Качество звука и синхронизации губ мы отдельно не сравнивали.

  • Стартовый кадр у двух моделей сделали мы. Grok Imagine 1.5 Preview и Runway Gen-4 Turbo не принимают текст, и кадр для них сгенерировали в их же моделях для изображений. Это не лобовое сравнение с текстовыми генераторами: половину работы они получили готовой.

  • Оценка картинки глазами, одним человеком. Без слепого просмотра и второго оценщика. Баллы за качество стоит читать как мнение, а не как измерение.

  • Не проверяли: деньги и тарифы, лицензии и права на коммерческое использование, работу с референсами персонажа на нескольких генерациях. Токены и минуты показывают то, что дал прогон через SYNTX.AI, а не прайс сервисов.

Повторить тест

Все двенадцать моделей из этого рейтинга доступны в одном месте: в SYNTX.AI их можно прогнать на одной задаче с одним промптом, не переключаясь между сервисами. Для читателей Хабра действует промокод CTRLAI: скидка 20% на любой тариф.

Источники

Характеристики и даты релизов моделей сверяли с официальными страницами разработчиков по состоянию на 9 октября 2026 года:

  • Seed (ByteDance), Seedance 2.5, Seedance 2.0: длина сцены, референсы, звук.

  • Kling AI (Kuaishou), Kling 3.0: раскадровка, длина, синхронизация губ.

  • Google AI for Developers и DeepMind, Gemini Omni Flash 1.1 и Veo 3.1: разрешения, диалоги, референсы.

  • xAI, Grok Imagine 1.5 Preview: работа от стартового кадра, звук, разрешения.

  • Black Forest Labs, FLUX 3 Video: архитектура, длина, частота кадров.

  • Runway, Gen-4.5 и Gen-4 Turbo: разрешения, тарифы в кредитах, ProRes и Lip Sync.

  • Luma, Ray 3.14: разрешения, EXR, отличия от Ray 3.0.

  • MiniMax, Hailuo 3.0 (H3): длина, разрешение, языки диалогов.

  • Alibaba, Wan 2.7: первый и последний кадр, сетка из девяти картинок.

Формат проверки «одна задача на все модели» ориентировался на обзоры CNET, Pexo и invideo: это пример того, как такие тесты собирают другие.