Сравнения

Лучшие нейросети для видео: сравнение по зачётам

30.08.2026

Лучшие нейросети для видео названы здесь по слепым голосам зрителей. Человеку показывают два ролика, сделанных по одному описанию, названия моделей скрыты — он выбирает, какой лучше. Из десятков тысяч таких голосов складывается место модели в двух независимых зачётах, и рядом стоят цена минуты готового видео у разработчика и замеренное время одной генерации. У каждого числа назван источник и дата снятия: зачёты пересчитываются постоянно, и через месяц порядок в них другой.

Разбор устроен по работам, а не по одному общему списку. Ролик по описанию, оживление картинки, видео по образцам, правка готового ролика, продление, речь под звуковую дорожку и увеличение разрешения — это семь разных работ, и наверху у каждой стоят разные модели.

Попробуйте видеомодель прямо здесь — чат с нейросетью онлайн, ниже на странице.

Топ нейросетей для видео: кто наверху в зачётах

Первая тройка в каждом зачёте на конец августа 2026 года выглядит так. Число рядом с моделью называется Elo — это её оценка в этом зачёте, сложенная из тех самых слепых голосов: чем Elo выше, тем чаще зрители выбирали ролик этой модели, не зная, кто его сделал. Со звуком и без звука — два отдельных списка с разным составом участников, и числа из разных списков между собой не сравниваются: у каждого зачёта своя шкала. Как устроен подсчёт, разобрано в следующем разделе.

Зачёт Первая тройка и Elo Дата снимка
Artificial Analysis, ролик по описанию, со звуком Wan 3.0 — 1242, Gemini Omni Flash — 1237, Minimax H3 Max в сборке fal — 1235 2026-08-30
Artificial Analysis, ролик по описанию, без звука Gemini Omni Flash — 1324, MiniMax H3 — 1301, HappyHorse-1.0 — 1283 2026-08-30
Artificial Analysis, оживление картинки, со звуком Minimax H3 Max в сборке fal — 1202, Dreamina Seedance 2.0 720p — 1190, MiniMax H3 — 1185 2026-08-30
Artificial Analysis, правка готового ролика, со звуком Wan 3.0 — 1189, MiniMax H3 — 1129, Gemini Omni Flash — 1124 2026-08-30
Arena, ролик по описанию gemini-omni-1.1-flash — 1515, gemini-omni-flash — 1512, flux-3-video — 1495 отсечка голосов 2026-08-25
Arena, оживление картинки minimax-h3 — 1494, gemini-omni-1.1-flash — 1488, dreamina-seedance-2.5-720p — 1483 отсечка голосов 2026-08-25
Arena, работа с готовым роликом wan3.0 — 1414, dreamina-seedance-2.5-720p — 1410, minimax-h3 — 1392 отсечка голосов 2026-08-26

Первые места в этих семи строках делят три семейства: Wan 3.0 стоит первым в трёх зачётах, Gemini Omni Flash вместе со своей версией 1.1 — в двух, MiniMax H3 в двух видах — в оставшихся двух. Ниже первой строки порядок расходится сильнее: модель, которая выигрывает ролики по описанию со звуком, не обязательно выигрывает оживление картинки, а на правке готового ролика может уступать. Дальше каждая работа разобрана отдельно, с полными таблицами и ценами.

Из имён, которые стоят в этих строках, в каталоге GEN202 работают Seedance 2.0 тремя уровнями, Kling 3.0 и Kling 3.0 Turbo, Wan 2.7 четырьмя записями, Kling 3.0 Motion Control и Veo 3.1 тремя уровнями. Цена их секунды и ссылки на страницы собраны в разделе про деньги ниже.

Что меряют арены и как читать их числа

Числа этой страницы пришли из четырёх источников. Различаются они тем, кто голосует и что именно считается.

Artificial Analysis, Video Arenas. Оценивающий видит два ролика по одному и тому же запросу, не зная, какая модель сделала каждый, и выбирает лучший. Из этих голосов считается Elo: чем он выше, тем чаще модель выбирают. Зачётов два — модели со звуком и модели без звука, и они не смешиваются. Рядом с Elo источник публикует цену минуты готового видео и число голосов. Дата снимка — 2026-08-30, это дата забора данных: собственную дату пересчёта рейтингов Artificial Analysis на странице не публикует. Адреса зачётов: ролик по описанию, оживление картинки, правка ролика.

Arena, бывшая LMArena. Та же схема слепых парных голосов живых пользователей, но своя аудитория и свои цифры. Источник сам публикует момент отсечки голосов — день, по который голоса вошли в подсчёт, — и это делает его даты точнее: для роликов по описанию отсечка 2026-08-25 при 645 773 голосах и 46 моделях, для оживления картинки — та же отсечка при 1 836 936 голосах и 46 моделях, для работы с готовым роликом — 2026-08-26 при 27 930 голосах и 10 моделях. Адреса: ролик по описанию, оживление картинки, работа с готовым роликом.

VBench, VBench-2.0 и VBench-I2V. Автоматический зачёт команды Vchitect из Shanghai AI Laboratory с открытым кодом: модель генерирует ролики по фиксированному набору запросов, дальше набор метрик считает согласованность объекта и фона, плавность движения, эстетику и соответствие тексту. Страница снята 2026-08-30, но у каждой строки собственная дата записи результата, и самая свежая строка в VBench 1.0 датирована 2026-08-07. Попадают в таблицу только те модели, которые кто-то прогнал и прислал, поэтому закрытых моделей 2026 года там нет. Ниже этот зачёт разобран отдельно — как история вопроса и как описание того, что вообще умеют мерить автоматически.

Movie Gen Bench от Meta. Набор из 1003 запросов и выложенных роликов, опубликованный вместе со статьёй arXiv 2410.13720, поданной 2024-10-17. Таблицы победных долей опубликованы только внутри статьи самой Meta, и сравнение с чужими моделями организовала она же. Это заявление разработчика о собственной модели, к тому же почти двухлетней давности, и место ему в истории вопроса, а не в ответе на вопрос о выборе.

Знак ± рядом с Elo в таблицах ниже — это доверительный интервал: разброс, в котором оценка может гулять в обе стороны. Узкий интервал говорит, что место строки известно точно, широкий — что оно приблизительное. Если у двух соседних строк интервалы перекрываются, порядок между ними зачёт не разделяет, и читать их надо как одну группу. Интервал тем уже, чем больше голосов набрала строка, поэтому колонку голосов смотрят вместе с ним.

Цена минуты у одной и той же модели различается между двумя зачётами: у Veo 3.1 это 24 доллара против 12, у Kling 3.0 1080p — 20,16 против 13,44. Числа перенесены как есть, каждое в своём зачёте, и сравнивать их между зачётами нельзя.

Лучшие нейросети для генерации видео: зачёт со звуком

Ролик со звуковой дорожкой, которую модель делает сама, идёт отдельным зачётом, и в нём собраны модели 2026 года. Данные Artificial Analysis, зачёт роликов по описанию со звуком, снимок 2026-08-30, всего в зачёте 38 моделей.

Место Модель Разработчик Elo Голосов Цена, $/мин
1 Wan 3.0 Alibaba 1242 (±9) 6254 12
2 Gemini Omni Flash Google 1237 (±6) 17 933 6
3 Minimax H3 Max в сборке fal Fal 1235 (±10) 5342 2,4
4 MiniMax H3 MiniMax 1227 (±7) 8904 7,8
5 Dreamina Seedance 2.0 720p ByteDance Seed 1221 (±5) 24 692 9,07
6 Wan2.7-260612 Alibaba 1157 (±6) 19 347 9
7 HappyHorse-1.1 Alibaba-ATH 1145 (±6) 19 345 9,9
9 Kling 3.0 1080p (Pro) KlingAI 1108 (±5) 22 352 20,16
10 Wan 2.7 Alibaba 1106 (±7) 6071 9
12 Kling 3.0 720p (Standard) KlingAI 1100 (±5) 21 459 15,12
15 Veo 3.1 Google 1091 (±6) 9435 24
16 Veo 3.1 Lite Google 1089 (±6) 8872 4,8
19 Veo 3.1 Fast Google 1086 (±5) 20 163 9
22 Sora 2 Pro OpenAI 1077 (±9) 4937 30
25 grok-imagine-video SpaceXAI 1063 (±5) 19 068 4,2

Формулировка со страницы источника, снятая в тот же день, звучит прямо: Wan 3.0 ведёт среди моделей со звуком с Elo 1242. Между пятым и шестым местом разрыв в 64 пункта — 1221 у Seedance 2.0 против 1157 у Wan2.7-260612, и он шире доверительных интервалов обеих строк. Внутри самой пятёрки разница между первым и пятым местом составляет 21 пункт при интервалах от ±5 до ±10, то есть соседние строки там различаются на величину, сопоставимую с шириной их интервалов.

Число голосов рядом с Elo показывает, насколько точно известно место. У Dreamina Seedance 2.0 720p 24 692 голоса и интервал ±5, у Wan 3.0 — 6254 голоса и интервал ±9. Модель с шестью тысячами голосов стоит на первом месте по среднему, но её место известно грубее, чем место модели с двадцатью пятью тысячами.

Цена идёт в таблице своей колонкой и с местом не связана. Третье место — Minimax H3 Max в сборке fal — обходится в 2,4 доллара за минуту, а пятнадцатое, Veo 3.1, — в 24 доллара: десятикратная разница в цене при разнице в 144 пункта Elo. Kling 3.0 в старшем варианте 1080p занимает девятое место при цене 20,16 доллара за минуту, Wan 2.7 при цене 9 долларов — десятое, и между ними два пункта Elo.

Голосование открыто всем: проголосовать в арене Artificial Analysis может любой человек, и его голос попадает ровно в те числа, которые вы читаете.

Тот же вопрос без звука даёт другой порядок

Модели, которые делают только изображение, считаются отдельным зачётом, и он крупнее: 91 модель против 38. Данные Artificial Analysis, зачёт роликов по описанию без звука, снимок 2026-08-30.

Место Модель Разработчик Elo Голосов Цена, $/мин
1 Gemini Omni Flash Google 1324 (±9) 6809 6
2 MiniMax H3 MiniMax 1301 (±10) 5614 7,8
3 HappyHorse-1.0 Alibaba-ATH 1283 (±8) 7548 13,2
4 Dreamina Seedance 2.0 720p ByteDance Seed 1267 (±7) 12 673 9,07
5 HappyHorse-1.1 Alibaba-ATH 1262 (±8) 7231 9,9
6 Wan2.7-260612 Alibaba 1243 (±8) 7005 9
7 Kling 3.0 1080p (Pro) KlingAI 1238 (±7) 10 756 13,44
9 grok-imagine-video SpaceXAI 1221 (±7) 11 203 4,2
13 Wan 2.7 Alibaba 1214 (±9) 3836 9
17 Kling 3.0 720p (Standard) KlingAI 1212 (±7) 10 300 10,08
26 Veo 3.1 Google 1199 (±8) 6678 12
43 Hailuo 2.3 MiniMax 1169 (±7) 8686 2,8

Первое место здесь у Gemini Omni Flash с Elo 1324 — это тоже дословная формулировка источника, снятая 2026-08-30. Kling 3.0 в старшем варианте поднимается с девятого места на седьмое, а HappyHorse-1.0, который в зачёте со звуком стоит восьмым, здесь третий.

Смена порядка между двумя зачётами идёт от того, что человек в них оценивает. В зачёте со звуком он выбирает ролик вместе со звуковой дорожкой, в зачёте без звука — только картинку и движение. Выбирать зачёт для себя стоит по тому, как вы собираетесь работать: если звук вы кладёте своей дорожкой на монтаже, ориентир — второй зачёт.

Отдельно про Hailuo 2.3: сорок третье место при Elo 1169 и цене 2,8 доллара за минуту. Соседние по Elo строки того же зачёта стоят дороже — Seedance 1.5 pro при Elo 1170 идёт по 5,93 доллара за минуту, декабрьская Sora 2 при 1167 — по 6.

Вторая арена: те же модели глазами другой аудитории

Arena считает те же слепые голоса, но своей аудиторией, и полезна как проверка: если две независимые арены ставят модель высоко, это уже не особенность одной площадки. Колонка Arena score — та же оценка из слепых голосов, только по шкале этой площадки: рядом с Elo из таблиц Artificial Analysis её не ставят, сравнивать можно лишь порядок строк внутри каждой таблицы. Данные Arena, зачёт роликов по описанию, отсечка голосов 2026-08-25, 645 773 голоса, 46 моделей.

Место Модель Организация Arena score Голосов Цена, $/сек
1 gemini-omni-1.1-flash Google 1515 1762
2 gemini-omni-flash Google 1512 19 830
3 flux-3-video Black Forest Labs 1495 1287
4 dreamina-seedance-2.0-720p Bytedance 1479 51 266
5 dreamina-seedance-2.5-720p Bytedance 1476 2121
6 minimax-h3 MiniMax 1460 5813
8 happyhorse-1.0 Alibaba-ATH 1428 22 112
15 wan2.7-t2v Alibaba 1344 20 882
16 grok-imagine-video-720p SpaceXAI 1344 157 732 0,05
18 veo-3-audio Google 1340 18 941 0,75
20 seedance-v1.5-pro Bytedance 1256 75 890 0,247
27 kling-2.6-pro KlingAI 1216 73 066 0,07
30 hailuo-2.3 MiniMax 1205 79 981 0,045

Две арены сходятся в главном: семейство Gemini Omni Flash, Seedance 2.0, MiniMax H3, HappyHorse и Wan 2.7 стоит в верхней части обеих таблиц. Расходятся они в деталях — у Arena выше поднимается flux-3-video, которого в зачёте Artificial Analysis нет вовсе, а Seedance 2.5 появляется отдельной строкой рядом с 2.0.

Прочерк в колонке цены означает, что поле в данных страницы пустое. Там, где цена есть, она дана за секунду, а не за минуту, и переводить одно в другое стоит с оглядкой: это два разных источника, у каждого своя выборка провайдеров.

Лучшая нейросеть для создания видео по тексту

Первая работа выглядит так: вы пишете описание сцены словами, задаёте формат кадра и длительность, получаете готовый ролик. Всё, о чём шла речь в двух предыдущих разделах, — это она.

По совокупности двух арен верхнюю группу занимают Wan 3.0, Gemini Omni Flash, MiniMax H3 и Seedance 2.0. Из них в каталоге GEN202 открыты Seedance 2.0 и линейка Wan 2.7.

Seedance 2.0 делает ролик по описанию, оживляет картинку и работает по образцам, поддерживает разрешения от 480p до 4K, семь форматов кадра и длительность от 4 до 15 секунд. На той же странице лежат два облегчённых уровня — Seedance 2.0 Fast и Seedance 2.0 Mini, оба до 720p, с тем же набором работ. В зачёте Artificial Analysis со звуком строка Dreamina Seedance 2.0 720p стоит пятой с Elo 1221 на 24 692 голосах, а в Arena — четвёртой с 1479 на 51 266 голосах, снимок 2026-08-30 и отсечка 2026-08-25 соответственно. Обе строки собраны на десятках тысяч голосов.

Wan 2.7 в записи для роликов по описанию работает в 720p и 1080p, длительность от 2 до 15 секунд. В зачёте без звука июньская сборка Wan2.7-260612 стоит шестой с Elo 1243, апрельская Wan 2.7 — тринадцатой с 1214, снимок 2026-08-30. В Arena строка wan2.7-t2v стоит пятнадцатой с 1344 на 20 882 голосах.

Kling 3.0 делает ролик и по описанию, и из картинки, форматы кадра 16:9, 9:16 и 1:1, длительность от 3 до 15 секунд. Рядом на той же странице стоят две записи Turbo — для текста и для картинки, обе в 720p и 1080p. В зачёте со звуком старший вариант Kling 3.0 1080p стоит девятым с Elo 1108 на 22 352 голосах, младший 720p — двенадцатым с 1100 на 21 459 голосах.

Veo 3.1 открыт тремя уровнями — обычным, Fast и Lite, каждый в 720p, 1080p и 4K, длительность на выбор 4, 6 или 8 секунд, звук у него включён всегда. В зачёте со звуком обычный вариант стоит пятнадцатым с Elo 1091, Lite — шестнадцатым с 1089, Fast — девятнадцатым с 1086, и все три сняты 2026-08-30. Официальная цена Google за секунду: 0,4 доллара у обычного варианта в 720p и 1080p, 0,6 в 4K, 0,1 и 0,12 у Fast в 720p и 1080p, 0,05 и 0,08 у Lite.

Подробное парное сравнение двух из этих имён вынесено в отдельную статью — Kling или Veo: там разобраны два независимых теста живыми людьми на одинаковых заданиях и официальные заявления разработчиков. Здесь речь про всё поле сразу, и пара оттуда не пересказывается.

Лучшие нейросети для создания видео из фото

Вторая работа начинается с готового изображения: оно служит исходником, а описание задаёт, что в кадре должно произойти. Модель обязана удержать всё, что уже нарисовано, и добавить движение. Сам исходный кадр рисуют другие модели — они разобраны в статье про лучшую нейросеть для изображений. Свой зачёт у этой работы есть у обеих арен.

Данные Artificial Analysis, оживление картинки, зачёт со звуком, снимок 2026-08-30, всего 36 моделей.

Место Модель Разработчик Elo Голосов Цена, $/мин
1 Minimax H3 Max в сборке fal Fal 1202 (±9) 5363 2,4
2 Dreamina Seedance 2.0 720p ByteDance Seed 1190 (±6) 17 375 9,07
3 MiniMax H3 MiniMax 1185 (±8) 7233 7,8
4 Gemini Omni Flash Google 1179 (±7) 12 047 6
5 grok-imagine-video-1.5 SpaceXAI 1108 (±7) 6303 8,4
6 HappyHorse-1.1 Alibaba-ATH 1104 (±7) 13 478 9,9
9 Veo 3.1 Google 1085 (±7) 8817 24
11 Wan 2.7 Alibaba 1083 (±7) 5550 9
16 Kling 3.0 1080p (Pro) KlingAI 1070 (±6) 16 792 20,16
19 Kling 3.0 720p (Standard) KlingAI 1066 (±6) 16 727 15,6

Тот же вопрос в Arena, отсечка голосов 2026-08-25, 1 836 936 голосов, 46 моделей: первое место у minimax-h3 с 1494 на 27 308 голосах, второе у gemini-omni-1.1-flash с 1488, третье у dreamina-seedance-2.5-720p с 1483, четвёртое у dreamina-seedance-2.0-720p с 1477 на 110 372 голосах. Дальше идут grok-imagine-video-1.5-720p с 1459 на 111 667 голосах, wan2.7-i2v с 1427 на 66 184 голосах и kling-v3-pro с 1356 на 180 932 голосах.

Две арены здесь сходятся именами: MiniMax H3, Seedance 2.0 и Gemini Omni Flash стоят в первой четвёрке у обеих.

Голосов в этом зачёте Arena больше, чем в двух других её видеозачётах: 1 836 936 против 645 773 у роликов по описанию при той же отсечке 2026-08-25 и 27 930 у работы с готовым роликом. Чем больше голосов, тем уже доверительные интервалы и тем точнее известен порядок строк.

В каталоге эту работу закрывают четыре записи. У Wan 2.7 это запись image-to-video — 720p и 1080p, от 2 до 15 секунд. У Kling 3.0 таких записей две: Turbo image-to-video в 720p и 1080p с длительностью от 3 до 15 секунд и основная запись, которая принимает и картинку, и текст. Seedance 2.0 с двумя облегчёнными уровнями оживляет картинку в тех же разрешениях, что и генерирует ролик с нуля. Порядок работы с исходным снимком, кадром и длительностью разобран на отдельной странице — оживить фото.

Видео по образцам: свой герой и своя вещь в кадре

Третья работа отличается от первых двух исходником: модели дают не одну картинку, которая станет первым кадром, а набор образцов — лицо человека, предмет, стиль, — и просят собрать новую сцену с ними. Так снимают серию роликов, в которых один и тот же герой или один и тот же товар.

Ближайший к этой работе зачёт — работа с готовым роликом у Arena, отсечка голосов 2026-08-26, 27 930 голосов, 10 моделей: wan3.0 — 1414 при интервале от 1388 до 1440, dreamina-seedance-2.5-720p — 1410, minimax-h3 — 1392, gemini-omni-flash — 1367, dreamina-seedance-2.0-720p — 1365, happyhorse-1.0 — 1307, grok-imagine-video — 1258, kling-o3-pro — 1255, kling-o1-pro — 1197, runway-gen4-aleph — 1182. Голосов в нём 27 930 против 645 773 в зачёте роликов по описанию, а у первой строки на 463 голосах доверительный интервал шириной в 52 пункта — от 1388 до 1440.

В каталоге работа по образцам открыта тремя записями. Запись reference-to-video у Wan 2.7 принимает образцы и собирает ролик в 720p или 1080p длиной от 2 до 10 секунд, форматы кадра 16:9, 9:16, 1:1, 4:3 и 3:4. Seedance 2.0 и оба её облегчённых уровня, Fast и Mini, делают то же самое в своих разрешениях. Kling 3.0 Motion Control решает соседнюю задачу — переносит движение из готового ролика на статичный кадр, работает в 720p и 1080p, официальная цена разработчика от 0,126 до 0,168 доллара за секунду.

Лучшая нейросеть для обработки видео: правка готового ролика

Четвёртая работа начинается с готового ролика: он уже снят или уже сгенерирован, и его надо изменить — заменить фон, убрать предмет, переписать сцену словами. У Artificial Analysis для неё заведён отдельный зачёт, и он самый короткий из всех: девять моделей со звуком и восемь без.

Данные Artificial Analysis, правка ролика, зачёт со звуком, снимок 2026-08-30.

Место Модель Разработчик Elo Голосов Цена, $/мин
1 Wan 3.0 Alibaba 1189 (±7) 5249 12
2 MiniMax H3 MiniMax 1129 (±5) 12 885 7,8
3 Gemini Omni Flash Google 1124 (±5) 15 853 6
4 HappyHorse-1.0 Alibaba-ATH 1088 (±5) 23 417 27,04
5 Wan 2.7 Alibaba 1077 (±5) 19 158 16,9
6 Dreamina Seedance 2.0 720p ByteDance Seed 1039 (±5) 23 239 5,57
7 Aleph 2.0 Runway 1013 (±5) 20 748 16,8
8 Kling 3.0 Omni 1080p (Pro) KlingAI 1000 (±0) 18 885 10,91
9 SkyReels V4 Skywork AI 949 (±6) 15 761 37,5

Тот же зачёт без звука, снимок той же даты, восемь моделей: Gemini Omni Flash — 1132, Wan 2.7 — 1097, MiniMax H3 — 1093, HappyHorse-1.0 — 1084, Dreamina Seedance 2.0 720p — 1067, SkyReels V4 — 1054, Aleph 2.0 — 1037, Kling 3.0 Omni 1080p — 1000. Wan 2.7 здесь стоит вторым против пятого места в зачёте со звуком.

Цена правки у одной и той же модели отличается от цены генерации. Wan 2.7 на генерации ролика стоит 9 долларов за минуту, а на правке — 16,9. HappyHorse-1.0 на генерации со звуком стоит 13,2, на правке — 27,04.

В каталоге эту работу закрывает запись Video Edit у Wan 2.7: 720p и 1080p, пять форматов кадра, длительность до 10 секунд.

Продление готового ролика

Пятая работа — дописать продолжение к уже готовому ролику, чтобы сцена шла дальше без склейки. Она устроена отдельным вызовом, потому что исходником служит не картинка и не текст, а сам ролик и его последний кадр.

В каталоге продление открыто у Grok Imagine отдельной записью, и счёт по ней идёт за вызов целиком: официальная цена разработчика от 0,36 до 0,8 доллара за генерацию. У Veo 3.1 продление вызывается собственным адресом наравне с генерацией и получением 1080p и 4K, а счёт выставляется за ролик — ставка за секунду умножается на выбранную длительность.

Речь и движение губ под звуковую дорожку

Шестая работа начинается со звука: у вас есть готовая запись голоса и портрет или ролик с человеком, и нужно, чтобы губы двигались под эту запись. Выбор здесь идёт по составу вызова: что модель принимает на вход и в каком разрешении отдаёт результат.

В каталоге на неё стоят две записи. Omnihuman 1.5 делает движение губ под звук, официальная цена разработчика 0,16 доллара за секунду. Infinitalk работает от звуковой дорожки в 480p и 720p, официальная цена от 0,2 до 0,4 доллара за секунду в зависимости от разрешения.

Звук внутри самих видеомоделей — это соседняя работа. Первый зачёт этой страницы собран из моделей, которые делают звуковую дорожку вместе с картинкой, и у Veo 3.1 звук включён всегда. Там звук появляется вместе с роликом, здесь ролик подстраивается под готовую запись.

Лучшие нейросети для улучшения качества видео

Седьмая работа поднимает разрешение готового ролика. В каталоге на неё стоит Topaz video-upscale с увеличением в 1, 2 или 4 раза, официальная цена разработчика 0,08 доллара за секунду.

Второй путь к тому же результату — сразу большое разрешение у самой видеомодели. Seedance 2.0 генерирует в 4K, Veo 3.1 отдаёт 1080p и 4K отдельными вызовами, у Kling 3.0 есть вариант 4K. Что выгоднее в вашем случае, считается по длительности: у Topaz счёт идёт за каждую секунду исходника, а у видеомодели ставка за секунду в 4K выше, чем в 720p.

Сколько стоит минута работы у разработчика

Цены ниже — из данных Artificial Analysis, снимок 2026-08-30, доллары за минуту готового видео. Они относятся к зачёту со звуком, где не отмечено иное.

Модель Цена, $/мин Место в зачёте со звуком
Agnes-Video-V2.0 0,3 38
Agnes-Video-2.5 1,5 21
Minimax H3 Max в сборке fal 2,4 3
LTX-2.3 Fast 2,4 32
Hailuo 2.3 (зачёт без звука) 2,8 43
grok-imagine-video 4,2 25
Veo 3.1 Lite 4,8 16
Gemini Omni Flash 6 2
Sora 2 (декабрьская) 6 14
MiniMax H3 7,8 4
Wan 2.7 9 10
Veo 3.1 Fast 9 19
Dreamina Seedance 2.0 720p 9,07 5
HappyHorse-1.1 9,9 7
Wan 3.0 12 1
HappyHorse-1.0 13,2 8
Kling 3.0 720p (Standard) 15,12 12
Kling 3.0 1080p (Pro) 20,16 9
SkyReels V4 21 11
Veo 3.1 24 15
Sora 2 Pro 30 22

Цена и место в зачёте расходятся. Первое место стоит 12 долларов за минуту, второе — 6, третье — 2,4, а двадцать второе — 30. Самая дорогая строка зачёта, Sora 2 Pro за 30 долларов, стоит на двадцать втором месте из тридцати восьми; самая дешёвая, Agnes-Video-V2.0 за 0,3 доллара, — на тридцать восьмом.

Отсюда следует порядок выбора: сначала берётся группа близких по Elo моделей, а цена сравнивается уже внутри неё. В верхней пятёрке зачёта со звуком разброс цены от 2,4 до 12 долларов за минуту при разнице в 21 пункт Elo.

Ставка за минуту — не единственная единица счёта на рынке. Часть этих же моделей продаётся внутри чужой месячной подписки, где расход считают не минутами, а кредитами тарифа: так устроен Higgsfield, и состав его линейки разобран отдельно — какие модели он раздаёт.

Тем же способом продаёт доступ Luma: Kling 3.0 стоит в её прайсе чужой строкой, а имя, под которым её ищут, у самого сервиса уже снято — разбор на странице Luma Dream Machine. Отдельно от этого ряда стоит HeyGen: чужих моделей в его прайсе нет ни одной, а работа у него своя — ролик с говорящим аватаром и перевод готового видео (что он умеет).

Скорость: сколько времени занимает одна генерация

Artificial Analysis замеряет медианное время генерации у каждого провайдера отдельно и публикует его рядом с ценой. Снимок 2026-08-30, колонка Elo относится к зачёту роликов по описанию без звука.

Модель Провайдер $/мин Elo Медианное время, с
MiniMax H3 MachGen 2,4 1301 6
MiniMax H3 fal.ai 3,6 1301 9
Veo 2 Google 30 1113 21
LTX-2.3 Fast fal.ai 2,4 1120 31
Seedance 1.0 BytePlus 7,32 1135 45
Seedance 1.5 pro BytePlus 5,93 1170 57
Kling 3.0 720p (Standard) fal.ai 10,08 1212 65
Kling 3.0 Omni 720p (Standard) fal.ai 10,08 1213 73
Hailuo 2.3 MiniMax 2,8 1169 86
Wan 2.5 Preview fal.ai 9 1158 111
HappyHorse-1.1 Alibaba Cloud 9,9 1262 118
Kling 3.0 1080p (Pro) fal.ai 13,44 1238 119
Sora 2 Pro OpenAI 30 1180 123
HappyHorse-1.0 Alibaba Cloud 13,2 1283 149

Одна и та же модель у разных провайдеров работает по-разному, и это видно в таблице напрямую: MiniMax H3 у MachGen отдаёт результат за 6 секунд при цене 2,4 доллара за минуту, а у Runware — за 126 секунд при цене 5,5 доллара за минуту. Модель одна, замеры разные.

Разрешение тоже стоит времени: Kling 3.0 в 720p замерен на 65 секундах, в 1080p — на 119, у одного и того же провайдера.

Лучшие китайские нейросети для видео

В верхней части обеих арен стоят модели китайских разработчиков: Alibaba, Alibaba-ATH, ByteDance Seed, MiniMax, KlingAI от Kuaishou, Vidu, Tencent. Рядом с ними в тех же строках идут Google, OpenAI и SpaceXAI.

Alibaba. Wan 3.0 — первая строка зачёта со звуком с Elo 1242 и первая строка правки ролика с Elo 1189, снимок 2026-08-30. Wan 2.7 идёт двумя сборками: июньской, шестое место в зачёте без звука с Elo 1243, и апрельской, тринадцатое место с 1214. HappyHorse от подразделения Alibaba-ATH выходит двумя версиями: 1.1 стоит седьмым в зачёте со звуком с Elo 1145, 1.0 — третьим в зачёте без звука с 1283.

ByteDance. Dreamina Seedance 2.0 720p — пятое место в зачёте со звуком с Elo 1221 на 24 692 голосах и второе место в оживлении картинки с 1190. В Arena рядом с ней стоит отдельная строка Seedance 2.5 с Arena score 1476 на роликах по описанию и 1483 на оживлении картинки, отсечка голосов 2026-08-25.

MiniMax. H3 стоит четвёртым в зачёте со звуком с Elo 1227 и вторым в зачёте без звука с 1301, а сборка Minimax H3 Max, дообученная площадкой fal, — третьей и первой соответственно в двух зачётах. Линейка Hailuo идёт ниже, но дешевле: Hailuo 2.3 при Elo 1169 в зачёте без звука стоит 2,8 доллара за минуту.

Kuaishou. Kling 3.0 представлен четырьмя строками: 1080p и 720p, обычный и Omni. Старший вариант стоит девятым в зачёте со звуком с Elo 1108 на 22 352 голосах, а в Arena строка kling-v3-pro на оживлении картинки набрала 1356 на 180 932 голосах.

Модели с открытыми весами

Открытые веса — это когда модель выложена так, что её можно скачать и запустить на своём оборудовании, а лицензия рядом с ней говорит, на каких условиях это разрешено. Какие из этих моделей выложены именно так, видно в колонке лицензии у Arena, снимок с отсечкой голосов 2026-08-25: у minimax-h3 своя общественная лицензия, у wan-v2.2-a14b — Apache 2.0, у kandinsky-5.0-t2v-pro и kandinsky-5.0-t2v-lite — MIT, у ltx-2-19b и hunyuan-video-1.5 — общественные лицензии их разработчиков, у mochi-v1 — Apache 2.0.

Artificial Analysis выделяет этот разрез отдельной формулировкой, снятой 2026-08-30: среди моделей с открытыми весами в зачёте роликов по описанию со звуком ведёт MiniMax H3 с Elo 1227, за ним LTX-2.5 Pro с 1061 и LTX-2.5 Fast с 1059.

Между MiniMax H3 и первым местом того же зачёта, Wan 3.0, — 15 пунктов Elo. Это меньше, чем расстояние между четвёртым и шестым местом той же таблицы.

VBench: что показывает автоматический зачёт

Автоматический зачёт считает не голоса людей, а метрики: согласованность объекта и фона, плавность движения, эстетику, соответствие тексту. Из них складываются три числа, подписанные у источника по-английски: Quality Score — качество самой картинки, Semantic Score — совпадение ролика с запросом, Total Score — общий итог из первых двух. Страница снята 2026-08-30, у каждой строки своя дата записи результата.

Модель Дата записи Total Score Quality Score Semantic Score
HiDream-O1-Video 2026-08-07 89,74% 89,43% 90,99%
IPOW 2025-08-06 88,26% 87,83% 90,01%
Vidu Q1 2025-04-21 87,41% 87,28% 87,94%
Wan2.1 2025-02-24 86,22% 86,67% 84,44%
Veo 3 2025-08-06 85,06% 85,70% 82,49%
Wan2.2-T2V-A14B с подготовкой запроса 2026-02-18 84,23% 85,42% 79,50%
Kling 1.6 2025-05-08 83,40% 85,00% 76,99%

Всего в таблице источника 73 строки, и самая свежая из них датирована 2026-08-07. Закрытых моделей 2026 года — Kling 3.0, Seedance 2.0, Veo 3.1, Sora 2, Hailuo — в ней нет: попадают туда только те, кого кто-то прогнал по открытому коду зачёта и прислал результат. Поэтому строки выше читаются как история вопроса и как описание того, что автоматика вообще умеет мерить, а не как ответ на вопрос о сегодняшнем выборе.

Вторая версия зачёта, VBench-2.0, меряет другое, и её колонки тоже подписаны по-английски: Creativity — выдумка, Commonsense — бытовая правдоподобность, Controllability — послушность запросу, Human Fidelity — достоверность человека в кадре, Physics — правдоподобность движения предметов. В ней 12 строк, и самая свежая записана 2026-04-01 — это старше полугода на дату снимка, и место этих чисел тоже в истории. Первую строку там занимает Veo 3 с Total 66,72% и записью от 2025-09-04, дальше JT-CV с 64,60%, ABot-World v0.1 с 64,47%.

Третья таблица, VBench-I2V, оценивает оживление картинки: 35 строк, самая свежая от 2026-05-20. Наверху DreamX-World-1.0 с Total 90,49% при I2V Score 97,74% — эта колонка показывает, насколько готовый ролик остался верен исходной картинке, дальше ToMoviee-2.0 с 89,76% и Steamer-I2V с 89,38%. Сборки Wan 2.2 стоят там же: Wan2.2-TI2V-5B с подготовкой запроса — 88,80%, Wan2.2-I2V-A14B — 88,68%.

Отдельная история — Movie Gen Bench от Meta. Компания выложила 1003 запроса и собственные ролики вместе со статьёй arXiv 2410.13720, поданной 2024-10-17, и привела победные доли своей модели против чужих: против Kling 1.5 по общему качеству 3,87 процентного пункта при погрешности ±5,07, против Sora — 8,23. Сравнение организовала сама Meta и опубликовала его в собственной статье: это заявление разработчика о своей модели, а не независимый замер. Плюс данные почти двухлетней давности: моделей, о которых говорит эта страница, тогда не существовало.

Сводная таблица: что под какую работу

Числа в средней колонке — это Elo, оценка из слепых голосов зрителей: чем выше, тем чаще выбирали ролик этой модели. Сравнивать их можно только внутри одной строки, потому что у каждого зачёта своя шкала.

Работа Кто наверху в зачёте Что открыто в каталоге GEN202
Ролик по описанию со звуком Wan 3.0 — Elo 1242, Gemini Omni Flash — 1237 (Artificial Analysis, 2026-08-30) Kling 3.0, Seedance 2.0, Veo 3.1
Ролик по описанию без звука Gemini Omni Flash — 1324, MiniMax H3 — 1301 (Artificial Analysis, 2026-08-30) Wan 2.7, Kling 3.0 Turbo, Seedance 2.0 Fast
Оживление картинки Minimax H3 Max в сборке fal — 1202, Seedance 2.0 — 1190 (Artificial Analysis, 2026-08-30) Wan 2.7, Kling 3.0 в записи Turbo image-to-video, Seedance 2.0
Видео по образцам wan3.0 — 1414, seedance-2.5 — 1410 (Arena, отсечка 2026-08-26) Wan 2.7 в записи reference-to-video, Seedance 2.0, Kling 3.0 Motion Control
Правка готового ролика Wan 3.0 — 1189, MiniMax H3 — 1129 (Artificial Analysis, 2026-08-30) Wan 2.7 в записи Video Edit
Продление ролика выбор по входу: исходный ролик и его последний кадр Grok Imagine, Veo 3.1 отдельным вызовом
Губы под звуковую дорожку выбор по входу: готовая звуковая дорожка и разрешение Omnihuman 1.5, Infinitalk
Увеличение разрешения выбор по кратности увеличения и длительности исходника Topaz video-upscale, генерация сразу в 4K у Seedance 2.0 и Veo 3.1
Самая низкая цена минуты в верхней пятёрке Minimax H3 Max в сборке fal — 2,4 $/мин (Artificial Analysis, 2026-08-30) Seedance 2.0 Mini как младший уровень на странице Seedance 2.0

Таблица читается по строкам: под три разные работы здесь выходят три разных ответа, и это нормальный результат сравнения, а не противоречие внутри него.

Цена секунды у тех же моделей в GEN202

Все видеомодели каталога работают по одному ключу, счёт идёт рублями с карты российского банка, и оплата за границу в валюте для этого не нужна.

Секунда Kling 3.0 без звука стоит 7,6 ₽ в 720p и 10,1 ₽ в 1080p; со звуком — 11,3 ₽ и 15,1 ₽, а вариант 4K — 37,8 ₽. У Kling 3.0 Turbo для текста секунда стоит 10,1 ₽ в 720p и 12,6 ₽ в 1080p, у варианта Turbo для картинки — 10,1 ₽ и 12,6 ₽.

У Seedance 2.0 секунда ролика по описанию стоит 12,7 ₽ в 480p, 27,2 ₽ в 720p, 61,2 ₽ в 1080p и 140,4 ₽ в 4K. Когда исходником служит готовый ролик, ставка ниже: 16,3 ₽ за секунду в 720p. У Seedance 2.0 Fast те же 720p стоят 21,8 ₽ за секунду, у Seedance 2.0 Mini — 13,9 ₽, а 480p у Mini — 6,5 ₽.

Вся линейка Wan 2.7 считается одинаково: 9 ₽ за секунду в 720p и 13,5 ₽ в 1080p — и у оживления картинки, и у работы по образцам, и у правки готового ролика. Секунда Kling 3.0 Motion Control стоит 11,3 ₽ в 720p и 15,1 ₽ в 1080p. Цены Veo 3.1 собраны таблицей на его карточке: там разложены обычный уровень, Fast и Lite по трём разрешениям, потому что у Google разница между ними кратная.

Цена каталога ниже официальной цены разработчика: у большинства видеозаписей ровно на десять процентов, и считается разница по каждому варианту отдельно. Весь список видеомоделей с ценами и полями запроса собран на странице каталог видеомоделей, сводка по видам работы — на странице цен.

При регистрации на счёт приходит 50 кредитов (25 ₽), дальше пополнение идёт от 500 ₽. Голоса в аренах собраны на чужих сюжетах, а ваш сюжет свой: один и тот же сценарий отправляется в две-три модели подряд, и результаты видно рядом. Отправить запрос словами можно в чате: сценарий пишется сообщением, а разрешение, формат кадра и длительность задаются переключателями. Порядок работы с запросом и образцом разобран отдельно — как пользоваться Kling, как пользоваться Seedance, как пользоваться Veo и как пользоваться Wan. Общий обзор моделей и задач — на странице нейросеть для видео. Ответ по остальным задачам — тексту, картинкам, коду и русскому языку — собран в разборе лучшая нейросеть.

Частые вопросы

Какая нейросеть лучшая для видео?

Ответ зависит от работы, и это видно по числам. В зачёте роликов по описанию со звуком у Artificial Analysis на 2026-08-30 первая строка — Wan 3.0 с Elo 1242. В том же зачёте без звука первая строка другая — Gemini Omni Flash с 1324. На оживлении картинки со звуком наверху Minimax H3 Max в сборке fal с 1202, а в Arena на той же работе — minimax-h3 с 1494 при отсечке голосов 2026-08-25. На правке готового ролика снова Wan 3.0 с 1189. Выбирать стоит по своей работе и по цене внутри группы близких моделей: в верхней пятёрке зачёта со звуком разброс цены от 2,4 до 12 долларов за минуту при разнице всего в 21 пункт Elo.

Какая лучшая нейросеть для создания видео из фото?

По зачёту оживления картинки Artificial Analysis со снимком 2026-08-30 первые четыре строки заняли Minimax H3 Max в сборке fal с Elo 1202, Dreamina Seedance 2.0 720p с 1190, MiniMax H3 с 1185 и Gemini Omni Flash с 1179. Arena с отсечкой голосов 2026-08-25 на 1 836 936 голосах ставит наверх minimax-h3 с 1494, gemini-omni-1.1-flash с 1488 и dreamina-seedance-2.5-720p с 1483. Обе арены ставят в первую четвёрку одни и те же имена. Из каталога сюда подходят Wan 2.7 в записи image-to-video, Kling 3.0 в записи Turbo image-to-video и Seedance 2.0 с двумя облегчёнными уровнями.

Лучшая нейросеть для видео 2026 — как понять, что список не устарел?

По датам снимков. У каждой таблицы на этой странице стоит своя: у зачётов Artificial Analysis это 2026-08-30, дата забора данных, потому что собственную дату пересчёта источник не публикует; у Arena — момент отсечки голосов, который источник публикует сам: 2026-08-25 для роликов по описанию и оживления картинки, 2026-08-26 для работы с готовым роликом. Проверить свежесть можно самостоятельно: обе арены открыты, адреса указаны в разделе про методику, и строки в них меняются вместе с новыми голосами.

Какая нейросеть лучше всего генерирует видео со звуком?

Зачёт моделей со звуком у Artificial Analysis на 2026-08-30 ведёт Wan 3.0 с Elo 1242 на 6254 голосах. За ним идут Gemini Omni Flash с 1237 на 17 933 голосах и Minimax H3 Max в сборке fal с 1235 на 5342 голосах. Из моделей каталога в этом зачёте выше всех стоит Dreamina Seedance 2.0 720p — пятое место с Elo 1221 на 24 692 голосах. У Veo 3.1 звук включён всегда и не отключается, его строка в этом зачёте пятнадцатая с Elo 1091.

Лучшие нейросети для редактирования видео — что выбрать?

Зачёт правки готового ролика у Artificial Analysis самый короткий из всех: девять моделей со звуком и восемь без. На 2026-08-30 со звуком наверху Wan 3.0 с Elo 1189, MiniMax H3 с 1129 и Gemini Omni Flash с 1124; без звука порядок другой — Gemini Omni Flash с 1132, Wan 2.7 с 1097, MiniMax H3 с 1093. В каталоге эту работу закрывает запись Video Edit у Wan 2.7 в 720p и 1080p с длительностью до 10 секунд, а перенос движения из готового ролика на статичный кадр — Kling 3.0 Motion Control.

Лучшие нейросети для оживления видео и старых кадров?

Оживление начинается с изображения, и работает здесь тот же зачёт, что и у создания видео из фото: наверху Minimax H3 Max в сборке fal, Seedance 2.0 и MiniMax H3 по снимку Artificial Analysis от 2026-08-30. Практическая сторона разобрана на отдельной странице — оживить фото, где показан порядок работы с исходным снимком, форматом кадра и длительностью.

Чем эта страница отличается от сравнения Kling и Veo?

Здесь всё поле видеомоделей по числам двух арен и разбор по семи работам. В статье Kling или Veo разобрана одна пара и другой тип источника: два независимых теста живыми людьми на одинаковых заданиях, с цитатами авторов и официальными заявлениями разработчиков. Страницы дополняют друг друга: арены показывают порядок на большой выборке голосов, а разбор пары — что происходит с конкретными сюжетами.

Что показывает VBench и почему его чисел мало на этой странице?

VBench считает метрики автоматически, без голосов людей, по открытому коду: любой может прогнать модель и прислать результат. Из-за этого в таблице оказываются только те модели, которые кто-то прогнал: закрытых моделей 2026 года — Kling 3.0, Seedance 2.0, Veo 3.1, Sora 2, Hailuo — там нет. Самая свежая строка VBench 1.0 записана 2026-08-07, у второй версии зачёта самая свежая строка датирована 2026-04-01. Поэтому VBench на этой странице стоит как история вопроса и как описание того, что умеет мерить автоматика.

Лучшие китайские нейросети для видео — какие они?

Они занимают большую часть верхних строк обеих арен. Wan 3.0 от Alibaba — первое место в зачёте со звуком с Elo 1242 и в правке ролика с 1189. Dreamina Seedance 2.0 720p от ByteDance — пятое место в зачёте со звуком с 1221 и второе в оживлении картинки с 1190. MiniMax H3 — четвёртое место со звуком с 1227 и второе без звука с 1301. HappyHorse 1.1 от Alibaba-ATH — седьмое место со звуком с 1145. Kling 3.0 от Kuaishou — девятое место со звуком с 1108, а в Arena его строка на оживлении картинки собрала 180 932 голоса. Все числа сняты 2026-08-30 у Artificial Analysis и с отсечкой голосов 2026-08-25 у Arena.

Чат с нейросетью онлайн

Kling, Seedance, Wan и другие нейросети — в одном окне, прямо в браузере. Выберите нужную в списке над полем ввода и опишите сцену словами: первая работа идёт за счёт сервиса. Больше моделей и история разговоров — в чате с нейросетью.