Рейтинг нейросетей для видео: сравнил 12 моделей на одном промпте (октябрь 2026). Блог компании SYNTX.AI.. Блог компании SYNTX.AI. генерация видео.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект. лучшая нейросеть для видео 2026.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект. лучшая нейросеть для видео 2026. нейросети для видео.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект. лучшая нейросеть для видео 2026. нейросети для видео. Работа с видео.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект. лучшая нейросеть для видео 2026. нейросети для видео. Работа с видео. рейтинг нейросетей.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект. лучшая нейросеть для видео 2026. нейросети для видео. Работа с видео. рейтинг нейросетей. тест нейросетей.. Блог компании SYNTX.AI. генерация видео. генерация видео нейросетью. искусственный интеллект. лучшая нейросеть для видео 2026. нейросети для видео. Работа с видео. рейтинг нейросетей. тест нейросетей. топ нейросетей.

Двенадцать нейросетей для видео прогнали на одном промпте: 8 секунд, 720p, по одному прогону (одной генерации) на модель. Первым по сумме баллов вышел Luma Ray 3.14: 9,1 из 10, две минуты, 5 токенов, дешевле всех в списке. Лучшую картинку показала Seedance 2.5, и она же самая дорогая: 138,7 токена, в 27 раз дороже лидера.

Рейтинг нейросетей для видео: сравнил 12 моделей на одном промпте (октябрь 2026) - 1

Проверено 9 октября 2026 года. Версии всех моделей указаны по состоянию на эту дату.

В марте 2026 года OpenAI закрыла Sora. Модель, с которой год назад сравнивали всех остальных. В этом списке её нет, и место Sora никто не занял целиком: его поделили между собой двенадцать генераторов ниже.

Карточки моделей похожи друг на друга до скуки: 1080p, звук, 10-15 секунд, референсные изображения (образцы, по которым модель держит персонажа или стиль). Обычные рейтинги нейросетей для видео сравнивают именно эти характеристики, и по ним модель не выбирается: у половины списка цифры совпадают, а разница в разрешении и длине сцены перекрывает разницу в том, как модель работает. Увидеть её можно только тогда, когда всем дают одну и ту же задачу.

Так что задача была одна: двенадцать моделей, один промпт, одно разрешение и ни одной подсказки о том, как каждая из них себя поведёт.


Дальше: как считали, полная таблица с баллами и разбор по каждой модели.

Короткий ответ

  • По сумме баллов: Luma Ray 3.14, 9,1 из 10, две минуты, 5 токенов. Дешевле всех в списке, но ролик требует цветокоррекции, а звука и референса персонажа у модели нет.

  • По картинке: Seedance 2.5. Единственная сделала задачу без скидок и самая дорогая в тесте: 138,7 токена и шесть минут.

  • Быстро и дёшево: Gemini Omni Flash 1.1, 10,5 токена и минута, при потолке 720p и десяти секундах.

  • Для эпизода с несколькими планами и репликами: Kling 3.0, от 3 до 15 секунд, звук и синхронизация губ, без провалов.

  • Хуже всех: Wan 2.7, 3,2 из 10, десять минут на генерацию и проигрыш по всем трём частям оценки.

Как тестировали нейросети для видео: один промпт, 8 секунд, 720p

Один текстовый промпт на двенадцать моделей. 8 секунд, 16:9 и 720p, чтобы все оказались в одинаковых условиях.

720p выбран намеренно, хотя половина моделей умеет больше. Сравнивать 4K против 720p бессмысленно, разница в разрешении перекроет разницу в качестве работы. Все двенадцать снимали на одном и том же разрешении.

Почему восемь секунд? Veo 3.1 за один проход больше не делает, а ставить 8 секунд рядом с 15 нечестно.

Смотрели, держится ли объект от первого кадра до последнего и как ведут себя огонь, пар, дым и вода. Проверяли, сделала ли модель то, что написано в промпте, и считали время с расходом.

Звук оценивали отдельно. У Runway и Luma своего звука нет, и снимать с них за это баллы в общей оценке странно.

Grok Imagine 1.5 Preview работает только от стартового кадра, текстом его не запустить. Та же история с Runway Gen-4 Turbo. Для них сделали исключение: стартовый кадр сгенерировали в их собственных моделях для изображений, в Grok и Runway Frames, и уже от изображения получили видео. Прогон остался один, как у всех.

Каждую модель запускали по разу. В реальности такое редко даёт идеальный результат, обычно нужны попытки. Тем интереснее: справятся ли модели с одной? Второй попытки не делали никому, в том числе Veo 3.1, у которой единственный прогон вышел самым слабым в верхней половине списка.

По ходу теста все модели выдали результат без ошибок и сбоев, а на генерацию потребовалось до 1 часа. Почти всё это время ушло на ожидание, а не на работу: у Gemini на ролик уходит минута, у Wan десять.

Все двенадцать прогонов шли через SYNTX.AI. Одна среда, один аккаунт, один формат учёта токенов. Токен у каждого сервиса считается по-своему, и расход между разными платформами складывать нельзя. Здесь единица учёта одна на весь тест, поэтому цифры сопоставимы между собой.

Промпт для теста: одна задача на двенадцать моделей

A street food vendor at a rainy night market tosses noodles in a wok, flames leap up, steam rises into neon light, raindrops hit the awning, camera slowly pushes in from a medium shot to a close-up of his hands, shot on 35mm film, shallow depth of field

В кадре за восемь секунд должны успеть появиться огонь, пар, дождь, неон, руки крупным планом и движение камеры. На руках и лапше модели ломаются чаще всего, а дым и пар проверяют, понимает ли модель физику, или просто рисует красивые пятна.

Промпт собран как ловушка. Скучная задача не показала бы разницы, все двенадцать выдали бы примерно одно и то же.

Все двенадцать роликов рядом:

Все модели, 8 с, 720p, тот же промпт

Все модели, 8 с, 720p, тот же промпт

Как считали оценки: качество 80%, скорость и цена по 10%

Итог собран из трёх частей: качество картинки и попадание в промпт (80%), скорость генерации (10%), экономия по токенам (10%).

Качество весит больше всего, потому что ролик заказывают ради картинки. Скорость и цена её только правят: ждать шесть минут неприятно, но не так неприятно, как получить брак за одну.

Качество ставили глазами, по десятибалльной. Скорость и экономию посчитали по прогону.

Скорость: 1 минута это 10 баллов, 10 минут это 1 балл, шкала линейная между ними.

Экономия: 5 токенов это 10 баллов, 138,7 токена это 1 балл. Токены считаем не абсолютной цифрой, а по разбросу внутри списка, иначе цифра ничего не говорит.

Модель

Время

Токены

Скорость

Экономия

Качество

Итог

Luma Ray 3.14

2 мин

5

9

10,0

9

9,1

Seedance 2.5

6 мин

138,7

5

1,0

10

8,6

FLUX 3 Video

2 мин

80

9

5,0

9

8,6

Kling 3.0

3 мин

48

8

7,1

8

7,9

Gemini Omni Flash 1.1

1 мин

10,5

10

9,6

7

7,6

Grok Imagine 1.5 Preview

1 мин

44

10

7,4

7

7,3

Veo 3.1

5 мин

119

6

2,3

8

7,2

Hailuo 3.0 (MiniMax H3)

3 мин

48

8

7,1

6

6,3

Seedance 2.0

3 мин

30,8

8

8,3

5

5,6

Runway Gen-4.5

4 мин

28

7

8,5

5

5,5

Runway Gen-4 Turbo

2 мин

28

9

8,5

4

5,0

Wan 2.7

10 мин

48

1

7,1

3

3,2

Всего на двенадцать роликов ушло 628 токенов.

Seedance 2.5 и FLUX 3 Video набрали одинаковые 8,6: у Seedance на балл выше картинка, а FLUX быстрее и дешевле, и эти преимущества гасят друг друга.

Первая пятёрка держится на качестве, а не на цене. Три из пяти её участников дорогие: Seedance 2.5 на 138,7 токена, FLUX на 80, Kling на 48. Две дешёвые, Luma и Gemini.

И места сильно зависят от того, какой из трёх частей дать больший вес. Ниже тот же прогон, посчитанный по 60 / 20 / 20.

Модель

80 / 10 / 10

60 / 20 / 20

Сдвиг

Luma Ray 3.14

1

1

0

Seedance 2.5

2

6

+4

FLUX 3 Video

3

2

−1

Kling 3.0

4

4

0

Gemini Omni Flash 1.1

5

3

−2

Grok Imagine 1.5 Preview

6

5

−1

Veo 3.1

7

8

+1

Hailuo 3.0 (MiniMax H3)

8

7

−1

Seedance 2.0

9

9

0

Runway Gen-4.5

10

10

0

Runway Gen-4 Turbo

11

11

0

Wan 2.7

12

12

0

Больше всех от смены веса страдает Seedance 2.5: четыре позиции. У остальных сдвиг не больше двух. Один и тот же прогон, одни и те же оценки, разный ответ на вопрос «что важнее».

Рейтинг нейросетей для видео: 12 моделей на одном промпте

Порядок собран из оценок выше: качество 80%, скорость 10%, экономия 10%. В подписях к роликам указаны модель, длина, разрешение и время генерации, чтобы их можно было сопоставить с таблицей.

1. Luma Ray 3.14: 9,1

Luma Ray 3.14, 8 с, 720p, генерация 2 мин

Luma Ray 3.14, 8 с, 720p, генерация 2 мин
Luma Ray 3.14 - 3 кадра (начало, середина, конец)

Luma Ray 3.14 – 3 кадра (начало, середина, конец)

Вышла 26 января 2026 года. Нативный 1080p, а на 720p в 4 раза быстрее и в 3 раза дешевле Ray 3.0.

Картинка и физика в порядке, ролик требует цветокоррекции. Расход 5 токенов. Лучший результат в списке, в 27 раз дешевле Seedance 2.5.

Главная фишка нужна не всем. Это вывод в формате EXR (OpenEXR: формат с расширенным динамическим диапазоном, HDR): готовый кадр можно нести колористу и красить без потерь. Для колориста это очень много, а тому, кто делает ролик для Reels, это ничего не даёт.

Звука нет. Референса персонажа тоже нет, то есть задать героя картинкой и удержать его между генерациями не получится.

Единственная модель, которая выиграла в обоих расчётах. Она сняла почти как лидер, а стоила копейки, и при любом весе оценки это работает в её пользу.

2. Seedance 2.5: 8,6

Seedance 2.5, 8 с, 720p, генерация 6 мин

Seedance 2.5, 8 с, 720p, генерация 6 мин
Seedance 2.5 - 3 кадра (начало, середина, конец)

Seedance 2.5 – 3 кадра (начало, середина, конец)

ByteDance выпустила её 31 июля 2026 года, и главная цифра у неё 30.

Тридцать секунд за проход, без склеек. У остальных моделей из списка потолок от 8 до 20 секунд. В запрос можно загрузить до 50 референсов: персонажей, локации, аудио. Если в готовом ролике сломался один кадр, его перерисовывают отдельно, а не генерируют всё заново.

Лучший результат теста по картинке. Десять баллов, придраться не к чему: огонь, пар, дым, руки, фактура. Из всех моделей здесь она одна сделала то, что просили, и не потребовала скидок.

Второе место при 6 минутах и 138,7 токена. Самый дорогой прогон в тесте. Если роликов будет серия, считать придётся каждый. Если это один ролик, на который не жалко денег, конкурентов у неё нет.

3. FLUX 3 Video: 8,6

FLUX 3 Video, 8 с, 720p, генерация 2 мин

FLUX 3 Video, 8 с, 720p, генерация 2 мин
FLUX 3 Video - 3 кадра (начало, середина, конец)

FLUX 3 Video – 3 кадра (начало, середина, конец)

Картинки, видео и звук FLUX 3 учила вместе, в одной архитектуре. До 20 секунд, Full HD, 24 кадра в секунду, звук.

Начать и закончить ролик она может на заданных кадрах, а уже готовое видео умеет продолжить.

Картинка, движения и физика в порядке. Балл сняли за одно: вместо наезда камеры модель переключилась на крупный план рук. Формально она сделала то, что просили, но сделала это монтажной склейкой, а не движением. Заметит такое только тот, кто смотрит ролик рядом с промптом.

80 токенов. Третья по расходу после Seedance 2.5 и Veo 3.1. От второго места её отделяют тысячные доли балла, и разница эта не в её пользу, а в пользу Seedance. Брать её стоит, когда нужен ровно один хороший ролик без раскадровки и дешевле Seedance.

4. Kling 3.0: 7,9

Kling 3.0, 8 с, 720p, генерация 3 мин

Kling 3.0, 8 с, 720p, генерация 3 мин
Kling 3.0 - 3 кадра (начало, середина, конец)

Kling 3.0 – 3 кадра (начало, середина, конец)

Veo снимает кадр. Kling снимает эпизод.

Kuaishou сделала ставку на раскадровку: от 3 до 15 секунд, несколько планов в одной генерации, звук и синхронизация губ сразу. Если в промпте три действия, модель раскладывает их по планам, а не сваливает в один.

Восемь баллов из десяти и ни одного провала. Три минуты, 48 токенов. Такой ролик можно ставить в серию, не пересматривая каждый.

Лучшая модель списка по соотношению качества и предсказуемости, если вам не нужны длинные сцены.

5. Gemini Omni Flash 1.1: 7,6

Gemini Omni Flash 1.1, 8 с, 720p, генерация 1 мин

Gemini Omni Flash 1.1, 8 с, 720p, генерация 1 мин
Gemini Omni Flash 1.1 - 3 кадра (начало, середина, конец)

Gemini Omni Flash 1.1 – 3 кадра (начало, середина, конец)

В списке она значится как Google Omni Flash 1.1, официально это Gemini Omni Flash. Семейство Omni Google показала на I/O 2026.

Сильная сторона не картинка. Ролик можно править прямо в диалоге: «убери машину», «пусть будет вечер». На вход она принимает текст, изображения, видео и аудио, то есть ролик можно переделать, не запуская генерацию заново.

Минута генерации и 10,5 токена. Второе место по экономии.

За эти деньги она справилась отлично. Единственный вопрос к размерам лапши, они слегка плавают. Картинку она отдаёт не как Veo и не как Seedance, но и стоит в десять раз меньше.

При весе на качестве она опускается с третьего места на пятое. Это цена её компромисса: быстрая и дешёвая, но не лучшая по картинке.

6. Grok Imagine 1.5 Preview: 7,3

Grok Imagine 1.5 Preview, 8 с, 720p, генерация 1 мин, стартовый кадр сгенерирован в Grok

Grok Imagine 1.5 Preview, 8 с, 720p, генерация 1 мин, стартовый кадр сгенерирован в Grok
Grok Imagine 1.5 Preview - 3 кадра (начало, середина, конец)

Grok Imagine 1.5 Preview – 3 кадра (начало, середина, конец)

xAI выпустила превью 30 мая 2026 года. Модель берёт стартовый кадр и описание движения. Звук, музыку и диалог с синхронизацией губ она делает за один проход. До 15 секунд, 480p или 720p.

Текст ей дать нельзя, как и Runway Gen-4 Turbo, поэтому кадр мы нарисовали ей в том же Grok. Со стартовой картинкой она справилась, включая дым от готовки. Минута и 44 токена.

Для своей цены этого достаточно. Здесь есть оговорка: половину работы модель получает готовой, и сравнивать её в лоб с текстовыми генераторами не совсем честно.

7. Veo 3.1: 7,2

Veo 3.1, 8 с, 720p, генерация 5 мин

Veo 3.1, 8 с, 720p, генерация 5 мин
Veo 3.1 - 3 кадра (начало, середина, конец)

Veo 3.1 – 3 кадра (начало, середина, конец)

Veo 3.1 вышла в октябре 2025 года. До 4K, звук с диалогами, до четырёх референсных изображений на генерацию.

У неё единственный прогон оказался самым слабым в дорогой половине списка: картинка на восемь баллов, но в промпт ролик попал. Мы отнёсли его в раздел неудачных попыток. Второй попытки мы не делали никому, поэтому в рейтинге стоит то, что вышло с первого раза.

По картинке она не уступает лидерам, и при второй попытке вполне могла бы побороться за верх таблицы. Но рейтинг построен на одном прогоне на модель, и здесь у неё седьмое место, а не первое. Пять минут ожидания и 119 токенов, немногим меньше, чем у Seedance 2.5, съедают всю разницу.

Вопрос не в том, умеет ли она снимать, а в том, сколько дублей уйдёт на нормальный кадр. От Grok Imagine её отделяет одна десятая балла. Формально седьмое место, по факту они с Grok ровесники в таблице.

Плюс потолок в восемь секунд за проход. Длиннее получается только продлением по кускам, и стыки потом придётся проверять глазами.

8. Hailuo 3.0 (MiniMax H3): 6,3

Hailuo 3.0, 8 с, 720p, генерация 3 мин

Hailuo 3.0, 8 с, 720p, генерация 3 мин
Hailuo 3.0 - 3 кадра (начало, середина, конец)

Hailuo 3.0 – 3 кадра (начало, середина, конец)

Официальное название у неё MiniMax H3, а в народе её называют Hailuo 3.0, по имени приложения. Вышла 31 июля 2026 года, в один день с Seedance 2.5, так что сравнивать их будут ещё долго.

До 15 секунд, до 2K, 24 кадра в секунду, стереозвук. Диалоги с синхронизацией губ на 11 языках.

Картинка и движения адекватные, три минуты и 48 токенов, столько же, сколько у Kling. Вопросы к физике: огонь и лапша ведут себя как-то не так. Не катастрофа, но именно на такой задаче это видно.

Два одинаковых результата по расходу разводятся качеством. Здесь 6 против 8, и в обоих расчётах Kling выше. Она нужна ради дублей на других языках, где Kling так не умеет.

9. Seedance 2.0: 5,6

Seedance 2.0, 8 с, 720p, генерация 3 мин

Seedance 2.0, 8 с, 720p, генерация 3 мин
Seedance 2.0 - 3 кадра (начало, середина, конец)

Seedance 2.0 – 3 кадра (начало, середина, конец)

Утешительным призом её не назовёшь. Seedance 2.0 возглавляла лидерборд Artificial Analysis, публичный рейтинг моделей по слепым сравнениям. От 1 до 15 секунд, звук генерирует сама.

Зачем она, если есть 2.5? Ради цены. Три минуты и 30,8 токена против шести минут и 138,7 у новой версии. Разница в четыре с половиной раза.

Картинка адекватная, а вот движения и физика под вопросом. Хуже всего то, что предметы пропадают. Лопатка входит в вок и не возвращается.

10. Runway Gen-4.5: 5,5

Runway Gen-4.5, 8 с, 720p, генерация 4 мин

Runway Gen-4.5, 8 с, 720p, генерация 4 мин
Runway Gen-4.5 - 3 кадра (начало, середина, конец)

Runway Gen-4.5 – 3 кадра (начало, середина, конец)

В 2026 году Runway продаёт не модель. Он продаёт мастерскую вокруг неё.

Gen-4.5 вышла 1 декабря 2025 года. 720p, 5 или 10 секунд. Своего звука нет, его добавляют через интеграцию с ElevenLabs или отдельную функцию Lip Sync (синхронизацию движения губ с записанной дорожкой).

Зато есть редактор, апскейл (увеличение разрешения готового ролика) и экспорт в ProRes 4444. Если ролик потом пойдёт в монтажку, это весит больше, чем лишнее разрешение.

Четыре минуты и 28 токенов, расход скромный. Проблема в другом: вопросы и к картинке, и к движениям, и к физике. Пять баллов за это. Мастерская вокруг сильная, а внутри неё модель прошлого поколения.

11. Runway Gen-4 Turbo: 5,0

Runway Gen-4 Turbo, 8 с, 720p, генерация 2 мин, стартовый кадр сгенерирован в Runway Frames

Runway Gen-4 Turbo, 8 с, 720p, генерация 2 мин, стартовый кадр сгенерирован в Runway Frames
Runway Gen-4 Turbo - 3 кадра (начало, середина, конец)

Runway Gen-4 Turbo – 3 кадра (начало, середина, конец)

Gen-4 вышла весной 2025 года, и главным в ней был персонаж, который не меняется от кадра к кадру по одному референсу. Тогда это было событием. Сейчас то же самое умеют почти все модели выше.

Turbo поставили в список ради сравнения с прошлым поколением. 28 токенов, столько же, сколько у Gen-4.5, но в 2 раза быстрее. На скорости все преимущества и заканчиваются.

Картинка лучше, чем у Wan. Физика и движения слабые. Четыре балла. Брать его смысла почти нет: за те же 28 токенов Gen-4.5 снимает лучше.

От Gen-4.5 его отделяют полбалла. При весе на картинке разрыв между ними виден отчётливее, чем при весе на цене.

12. Wan 2.7: 3,2

Wan 2.7, 8 с, 720p, генерация 10 мин

Wan 2.7, 8 с, 720p, генерация 10 мин
Wan 2.7 - 3 кадра (начало, середина, конец)

Wan 2.7 – 3 кадра (начало, середина, конец)

Модель Alibaba. Можно задать первый и последний кадр, собрать видео по сетке из девяти картинок и править готовый ролик текстовыми командами.

Пластиковая картинка, три балла из десяти. Движения и физика неестественные. Единственная модель, которая проиграла и по качеству, и по скорости, и её не спасает даже вес, считающий цену: при 60% на картинку она всё равно последняя.

Десять минут при 48 токенах. По расходу столько же, сколько у Kling и Hailuo, а ждать более чем в три раза дольше. Десять минут на ролик, который всё равно не пригодится.

Сводная таблица

Модель

Длина за проход

Максимум модели

Свой звук

Токены

Качество

Итог

Luma Ray 3.14

5 или 10 с

1080p

нет

5

9

9,1

Seedance 2.5

до 30 с

1080p

да

138,7

10

8,6

FLUX 3 Video

до 20 с

1080p

да

80

9

8,6

Kling 3.0

3-15 с

4K

да

48

8

7,9

Gemini Omni Flash 1.1

4-10 с

4K

да

10,5

7

7,6

Grok Imagine 1.5 Preview

до 15 с

720p

да

44

7

7,3

Veo 3.1

8 с

4K

да

119

8

7,2

Hailuo 3.0 (MiniMax H3)

до 15 с

2K

да, стерео

48

6

6,3

Seedance 2.0

до 15 с

4K

да

30,8

5

5,6

Runway Gen-4.5

5 или 10 с

720p

нет

28

5

5,5

Runway Gen-4 Turbo

5 или 10 с

720p

нет

28

4

5,0

Wan 2.7

до 15 с

1080p

да

48

3

3,2

В колонке «Максимум модели» стоит то, что модель умеет вообще. Тестировали все на 720p.

Как выбрать под свою задачу

Задача решается таблицей, а не «лучшей моделью вообще»: у каждой из первых пяти своя ниша, и они почти не пересекаются.

Если нужно

Берите

На что смотреть

Дешёвый ролик на 8 секунд, потоком

Luma Ray 3.14

цвет придётся править, звука нет

Один кадр без компромиссов, деньги не важны

Seedance 2.5

138,7 токена и шесть минут за прогон

Дешевле Seedance, но так же красиво

FLUX 3 Video

камеру может подменить склейкой

Эпизод с планами и репликами

Kling 3.0

длиннее 15 секунд не снимет

Считают каждый токен

Gemini Omni Flash 1.1

потолок 4K и 10 секунд, правки в диалоге

Оживить готовую фотографию со звуком

Grok Imagine 1.5 Preview

текстом не запускается, нужен стартовый кадр

Если задача не попадает ни в одну строку, ориентируйтесь на три цифры из таблицы: время генерации, расход и длину сцены за проход. Разница в картинке между первым и пятым местом меньше, чем разница в 27 раз по расходу между первым и вторым.

Что показал тест

Вес оценки решает больше, чем сами оценки. Seedance 2.5 с лучшей картинкой теста была шестой при весе 60% на качество и стала второй при 80%. Gemini Omni Flash 1.1 опустилась с третьего места на пятое. Спорить о том, какая модель лучше, бессмысленно, пока не договорились, что считаем важным.

Тот же эффект виден на Veo 3.1. По картинке у неё восемь баллов: столько же, сколько у Kling, и на балл меньше, чем у FLUX. Но 119 токенов и пять минут держат её на седьмом месте, и даже при весе 60% на качество она не поднимается. Дорогие секунды тянут среднее вниз сильнее, чем помогает качество, даже когда качество признано высоким.

Тревога за промпт была ложной. Мы ждали, что задача окажется слишком сложной и развалится у большинства: руки, лапша, дым и наезд камеры одновременно. Развалилась она у пятерых из двенадцати: четверо внизу таблицы и единственный прогон Veo 3.1, где картинка вышла на восемь баллов, что было бы отличным результатом для других моделей. Верх списка (Luma, FLUX, Kling, Gemini и Grok) отработал огонь, пар, дым и наезд камеры спокойно, а Seedance 2.5 прошла тест идеально.

Значит, выбирать между моделями стоит не по тому, справятся ли они вообще, а по цене, скорости и длине сцены. Разница в картинке между первым и пятым местом есть, но она меньше, чем разница в 27 раз по расходу между первым и вторым.

Ограничения теста

Здесь то, что рейтинг не показывает, и границы, за которые его выводы не выходят.

  • Один прогон на модель. Второй попытки не делали никому, включая Veo 3.1, у которой вышел не лучший результат для её возможностей. В реальной работе модель обычно запускают несколько раз.

  • Слабое место одного прогона. Один результат ничего не говорит о стабильности: неизвестно, повторит ли модель удачу со второй попытки. При втором дубле Veo 3.1 могла бы побороться за верх таблицы, но рейтинг считают по одному прогону, и он у всех одинаковый.

  • 720p. Половина моделей умеет больше, и про 4K, 2K или 1080p здесь ничего не сказано: разрешение измерялось одинаковое, чтобы разница в нём не перекрыла разницу в работе. Поведение моделей на своём максимуме не проверялось.

  • Восемь секунд. Потолок выбран по самой короткой модели списка. Всё, что модели умеют на 15-30 секундах, в тесте не видно.

  • Звук вне оценки. Он есть у большинства, но не у всех, поэтому в общий балл не вошёл. Качество звука и синхронизации губ мы отдельно не сравнивали.

  • Стартовый кадр у двух моделей сделали мы. Grok Imagine 1.5 Preview и Runway Gen-4 Turbo не принимают текст, и кадр для них сгенерировали в их же моделях для изображений. Это не лобовое сравнение с текстовыми генераторами: половину работы они получили готовой.

  • Оценка картинки глазами, одним человеком. Без слепого просмотра и второго оценщика. Баллы за качество стоит читать как мнение, а не как измерение.

  • Не проверяли: деньги и тарифы, лицензии и права на коммерческое использование, работу с референсами персонажа на нескольких генерациях. Токены и минуты показывают то, что дал прогон через SYNTX.AI, а не прайс сервисов.

Повторить тест

Все двенадцать моделей из этого рейтинга доступны в одном месте: в SYNTX.AI их можно прогнать на одной задаче с одним промптом, не переключаясь между сервисами. Для читателей Хабра действует промокод CTRLAI: скидка 20% на любой тариф.

Источники

Характеристики и даты релизов моделей сверяли с официальными страницами разработчиков по состоянию на 9 октября 2026 года:

  • Seed (ByteDance), Seedance 2.5, Seedance 2.0: длина сцены, референсы, звук.

  • Kling AI (Kuaishou), Kling 3.0: раскадровка, длина, синхронизация губ.

  • Google AI for Developers и DeepMind, Gemini Omni Flash 1.1 и Veo 3.1: разрешения, диалоги, референсы.

  • xAI, Grok Imagine 1.5 Preview: работа от стартового кадра, звук, разрешения.

  • Black Forest Labs, FLUX 3 Video: архитектура, длина, частота кадров.

  • Runway, Gen-4.5 и Gen-4 Turbo: разрешения, тарифы в кредитах, ProRes и Lip Sync.

  • Luma, Ray 3.14: разрешения, EXR, отличия от Ray 3.0.

  • MiniMax, Hailuo 3.0 (H3): длина, разрешение, языки диалогов.

  • Alibaba, Wan 2.7: первый и последний кадр, сетка из девяти картинок.

Формат проверки «одна задача на все модели» ориентировался на обзоры CNET, Pexo и invideo: это пример того, как такие тесты собирают другие.

Автор: syntxaiofficial

Источник