Лучшие нейросети для видео названы здесь по слепым голосам зрителей. Человеку показывают два ролика, сделанных по одному описанию, названия моделей скрыты — он выбирает, какой лучше. Из десятков тысяч таких голосов складывается место модели в двух независимых зачётах, и рядом стоят цена минуты готового видео у разработчика и замеренное время одной генерации. У каждого числа назван источник и дата снятия: зачёты пересчитываются постоянно, и через месяц порядок в них другой.
Разбор устроен по работам, а не по одному общему списку. Ролик по описанию, оживление картинки, видео по образцам, правка готового ролика, продление, речь под звуковую дорожку и увеличение разрешения — это семь разных работ, и наверху у каждой стоят разные модели.
Попробуйте видеомодель прямо здесь — чат с нейросетью онлайн, ниже на странице.
Топ нейросетей для видео: кто наверху в зачётах
Первая тройка в каждом зачёте на конец августа 2026 года выглядит так. Число рядом с моделью называется Elo — это её оценка в этом зачёте, сложенная из тех самых слепых голосов: чем Elo выше, тем чаще зрители выбирали ролик этой модели, не зная, кто его сделал. Со звуком и без звука — два отдельных списка с разным составом участников, и числа из разных списков между собой не сравниваются: у каждого зачёта своя шкала. Как устроен подсчёт, разобрано в следующем разделе.
| Зачёт | Первая тройка и Elo | Дата снимка |
|---|---|---|
| Artificial Analysis, ролик по описанию, со звуком | Wan 3.0 — 1242, Gemini Omni Flash — 1237, Minimax H3 Max в сборке fal — 1235 | 2026-08-30 |
| Artificial Analysis, ролик по описанию, без звука | Gemini Omni Flash — 1324, MiniMax H3 — 1301, HappyHorse-1.0 — 1283 | 2026-08-30 |
| Artificial Analysis, оживление картинки, со звуком | Minimax H3 Max в сборке fal — 1202, Dreamina Seedance 2.0 720p — 1190, MiniMax H3 — 1185 | 2026-08-30 |
| Artificial Analysis, правка готового ролика, со звуком | Wan 3.0 — 1189, MiniMax H3 — 1129, Gemini Omni Flash — 1124 | 2026-08-30 |
| Arena, ролик по описанию | gemini-omni-1.1-flash — 1515, gemini-omni-flash — 1512, flux-3-video — 1495 | отсечка голосов 2026-08-25 |
| Arena, оживление картинки | minimax-h3 — 1494, gemini-omni-1.1-flash — 1488, dreamina-seedance-2.5-720p — 1483 | отсечка голосов 2026-08-25 |
| Arena, работа с готовым роликом | wan3.0 — 1414, dreamina-seedance-2.5-720p — 1410, minimax-h3 — 1392 | отсечка голосов 2026-08-26 |
Первые места в этих семи строках делят три семейства: Wan 3.0 стоит первым в трёх зачётах, Gemini Omni Flash вместе со своей версией 1.1 — в двух, MiniMax H3 в двух видах — в оставшихся двух. Ниже первой строки порядок расходится сильнее: модель, которая выигрывает ролики по описанию со звуком, не обязательно выигрывает оживление картинки, а на правке готового ролика может уступать. Дальше каждая работа разобрана отдельно, с полными таблицами и ценами.
Из имён, которые стоят в этих строках, в каталоге GEN202 работают Seedance 2.0 тремя уровнями, Kling 3.0 и Kling 3.0 Turbo, Wan 2.7 четырьмя записями, Kling 3.0 Motion Control и Veo 3.1 тремя уровнями. Цена их секунды и ссылки на страницы собраны в разделе про деньги ниже.
Что меряют арены и как читать их числа
Числа этой страницы пришли из четырёх источников. Различаются они тем, кто голосует и что именно считается.
Artificial Analysis, Video Arenas. Оценивающий видит два ролика по одному и тому же запросу, не зная, какая модель сделала каждый, и выбирает лучший. Из этих голосов считается Elo: чем он выше, тем чаще модель выбирают. Зачётов два — модели со звуком и модели без звука, и они не смешиваются. Рядом с Elo источник публикует цену минуты готового видео и число голосов. Дата снимка — 2026-08-30, это дата забора данных: собственную дату пересчёта рейтингов Artificial Analysis на странице не публикует. Адреса зачётов: ролик по описанию, оживление картинки, правка ролика.
Arena, бывшая LMArena. Та же схема слепых парных голосов живых пользователей, но своя аудитория и свои цифры. Источник сам публикует момент отсечки голосов — день, по который голоса вошли в подсчёт, — и это делает его даты точнее: для роликов по описанию отсечка 2026-08-25 при 645 773 голосах и 46 моделях, для оживления картинки — та же отсечка при 1 836 936 голосах и 46 моделях, для работы с готовым роликом — 2026-08-26 при 27 930 голосах и 10 моделях. Адреса: ролик по описанию, оживление картинки, работа с готовым роликом.
VBench, VBench-2.0 и VBench-I2V. Автоматический зачёт команды Vchitect из Shanghai AI Laboratory с открытым кодом: модель генерирует ролики по фиксированному набору запросов, дальше набор метрик считает согласованность объекта и фона, плавность движения, эстетику и соответствие тексту. Страница снята 2026-08-30, но у каждой строки собственная дата записи результата, и самая свежая строка в VBench 1.0 датирована 2026-08-07. Попадают в таблицу только те модели, которые кто-то прогнал и прислал, поэтому закрытых моделей 2026 года там нет. Ниже этот зачёт разобран отдельно — как история вопроса и как описание того, что вообще умеют мерить автоматически.
Movie Gen Bench от Meta. Набор из 1003 запросов и выложенных роликов, опубликованный вместе со статьёй arXiv 2410.13720, поданной 2024-10-17. Таблицы победных долей опубликованы только внутри статьи самой Meta, и сравнение с чужими моделями организовала она же. Это заявление разработчика о собственной модели, к тому же почти двухлетней давности, и место ему в истории вопроса, а не в ответе на вопрос о выборе.
Знак ± рядом с Elo в таблицах ниже — это доверительный интервал: разброс, в котором оценка может гулять в обе стороны. Узкий интервал говорит, что место строки известно точно, широкий — что оно приблизительное. Если у двух соседних строк интервалы перекрываются, порядок между ними зачёт не разделяет, и читать их надо как одну группу. Интервал тем уже, чем больше голосов набрала строка, поэтому колонку голосов смотрят вместе с ним.
Цена минуты у одной и той же модели различается между двумя зачётами: у Veo 3.1 это 24 доллара против 12, у Kling 3.0 1080p — 20,16 против 13,44. Числа перенесены как есть, каждое в своём зачёте, и сравнивать их между зачётами нельзя.
Лучшие нейросети для генерации видео: зачёт со звуком
Ролик со звуковой дорожкой, которую модель делает сама, идёт отдельным зачётом, и в нём собраны модели 2026 года. Данные Artificial Analysis, зачёт роликов по описанию со звуком, снимок 2026-08-30, всего в зачёте 38 моделей.
| Место | Модель | Разработчик | Elo | Голосов | Цена, $/мин |
|---|---|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1242 (±9) | 6254 | 12 |
| 2 | Gemini Omni Flash | 1237 (±6) | 17 933 | 6 | |
| 3 | Minimax H3 Max в сборке fal | Fal | 1235 (±10) | 5342 | 2,4 |
| 4 | MiniMax H3 | MiniMax | 1227 (±7) | 8904 | 7,8 |
| 5 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1221 (±5) | 24 692 | 9,07 |
| 6 | Wan2.7-260612 | Alibaba | 1157 (±6) | 19 347 | 9 |
| 7 | HappyHorse-1.1 | Alibaba-ATH | 1145 (±6) | 19 345 | 9,9 |
| 9 | Kling 3.0 1080p (Pro) | KlingAI | 1108 (±5) | 22 352 | 20,16 |
| 10 | Wan 2.7 | Alibaba | 1106 (±7) | 6071 | 9 |
| 12 | Kling 3.0 720p (Standard) | KlingAI | 1100 (±5) | 21 459 | 15,12 |
| 15 | Veo 3.1 | 1091 (±6) | 9435 | 24 | |
| 16 | Veo 3.1 Lite | 1089 (±6) | 8872 | 4,8 | |
| 19 | Veo 3.1 Fast | 1086 (±5) | 20 163 | 9 | |
| 22 | Sora 2 Pro | OpenAI | 1077 (±9) | 4937 | 30 |
| 25 | grok-imagine-video | SpaceXAI | 1063 (±5) | 19 068 | 4,2 |
Формулировка со страницы источника, снятая в тот же день, звучит прямо: Wan 3.0 ведёт среди моделей со звуком с Elo 1242. Между пятым и шестым местом разрыв в 64 пункта — 1221 у Seedance 2.0 против 1157 у Wan2.7-260612, и он шире доверительных интервалов обеих строк. Внутри самой пятёрки разница между первым и пятым местом составляет 21 пункт при интервалах от ±5 до ±10, то есть соседние строки там различаются на величину, сопоставимую с шириной их интервалов.
Число голосов рядом с Elo показывает, насколько точно известно место. У Dreamina Seedance 2.0 720p 24 692 голоса и интервал ±5, у Wan 3.0 — 6254 голоса и интервал ±9. Модель с шестью тысячами голосов стоит на первом месте по среднему, но её место известно грубее, чем место модели с двадцатью пятью тысячами.
Цена идёт в таблице своей колонкой и с местом не связана. Третье место — Minimax H3 Max в сборке fal — обходится в 2,4 доллара за минуту, а пятнадцатое, Veo 3.1, — в 24 доллара: десятикратная разница в цене при разнице в 144 пункта Elo. Kling 3.0 в старшем варианте 1080p занимает девятое место при цене 20,16 доллара за минуту, Wan 2.7 при цене 9 долларов — десятое, и между ними два пункта Elo.
Голосование открыто всем: проголосовать в арене Artificial Analysis может любой человек, и его голос попадает ровно в те числа, которые вы читаете.
Тот же вопрос без звука даёт другой порядок
Модели, которые делают только изображение, считаются отдельным зачётом, и он крупнее: 91 модель против 38. Данные Artificial Analysis, зачёт роликов по описанию без звука, снимок 2026-08-30.
| Место | Модель | Разработчик | Elo | Голосов | Цена, $/мин |
|---|---|---|---|---|---|
| 1 | Gemini Omni Flash | 1324 (±9) | 6809 | 6 | |
| 2 | MiniMax H3 | MiniMax | 1301 (±10) | 5614 | 7,8 |
| 3 | HappyHorse-1.0 | Alibaba-ATH | 1283 (±8) | 7548 | 13,2 |
| 4 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1267 (±7) | 12 673 | 9,07 |
| 5 | HappyHorse-1.1 | Alibaba-ATH | 1262 (±8) | 7231 | 9,9 |
| 6 | Wan2.7-260612 | Alibaba | 1243 (±8) | 7005 | 9 |
| 7 | Kling 3.0 1080p (Pro) | KlingAI | 1238 (±7) | 10 756 | 13,44 |
| 9 | grok-imagine-video | SpaceXAI | 1221 (±7) | 11 203 | 4,2 |
| 13 | Wan 2.7 | Alibaba | 1214 (±9) | 3836 | 9 |
| 17 | Kling 3.0 720p (Standard) | KlingAI | 1212 (±7) | 10 300 | 10,08 |
| 26 | Veo 3.1 | 1199 (±8) | 6678 | 12 | |
| 43 | Hailuo 2.3 | MiniMax | 1169 (±7) | 8686 | 2,8 |
Первое место здесь у Gemini Omni Flash с Elo 1324 — это тоже дословная формулировка источника, снятая 2026-08-30. Kling 3.0 в старшем варианте поднимается с девятого места на седьмое, а HappyHorse-1.0, который в зачёте со звуком стоит восьмым, здесь третий.
Смена порядка между двумя зачётами идёт от того, что человек в них оценивает. В зачёте со звуком он выбирает ролик вместе со звуковой дорожкой, в зачёте без звука — только картинку и движение. Выбирать зачёт для себя стоит по тому, как вы собираетесь работать: если звук вы кладёте своей дорожкой на монтаже, ориентир — второй зачёт.
Отдельно про Hailuo 2.3: сорок третье место при Elo 1169 и цене 2,8 доллара за минуту. Соседние по Elo строки того же зачёта стоят дороже — Seedance 1.5 pro при Elo 1170 идёт по 5,93 доллара за минуту, декабрьская Sora 2 при 1167 — по 6.
Вторая арена: те же модели глазами другой аудитории
Arena считает те же слепые голоса, но своей аудиторией, и полезна как проверка: если две независимые арены ставят модель высоко, это уже не особенность одной площадки. Колонка Arena score — та же оценка из слепых голосов, только по шкале этой площадки: рядом с Elo из таблиц Artificial Analysis её не ставят, сравнивать можно лишь порядок строк внутри каждой таблицы. Данные Arena, зачёт роликов по описанию, отсечка голосов 2026-08-25, 645 773 голоса, 46 моделей.
| Место | Модель | Организация | Arena score | Голосов | Цена, $/сек |
|---|---|---|---|---|---|
| 1 | gemini-omni-1.1-flash | 1515 | 1762 | — | |
| 2 | gemini-omni-flash | 1512 | 19 830 | — | |
| 3 | flux-3-video | Black Forest Labs | 1495 | 1287 | — |
| 4 | dreamina-seedance-2.0-720p | Bytedance | 1479 | 51 266 | — |
| 5 | dreamina-seedance-2.5-720p | Bytedance | 1476 | 2121 | — |
| 6 | minimax-h3 | MiniMax | 1460 | 5813 | — |
| 8 | happyhorse-1.0 | Alibaba-ATH | 1428 | 22 112 | — |
| 15 | wan2.7-t2v | Alibaba | 1344 | 20 882 | — |
| 16 | grok-imagine-video-720p | SpaceXAI | 1344 | 157 732 | 0,05 |
| 18 | veo-3-audio | 1340 | 18 941 | 0,75 | |
| 20 | seedance-v1.5-pro | Bytedance | 1256 | 75 890 | 0,247 |
| 27 | kling-2.6-pro | KlingAI | 1216 | 73 066 | 0,07 |
| 30 | hailuo-2.3 | MiniMax | 1205 | 79 981 | 0,045 |
Две арены сходятся в главном: семейство Gemini Omni Flash, Seedance 2.0, MiniMax H3, HappyHorse и Wan 2.7 стоит в верхней части обеих таблиц. Расходятся они в деталях — у Arena выше поднимается flux-3-video, которого в зачёте Artificial Analysis нет вовсе, а Seedance 2.5 появляется отдельной строкой рядом с 2.0.
Прочерк в колонке цены означает, что поле в данных страницы пустое. Там, где цена есть, она дана за секунду, а не за минуту, и переводить одно в другое стоит с оглядкой: это два разных источника, у каждого своя выборка провайдеров.
Лучшая нейросеть для создания видео по тексту
Первая работа выглядит так: вы пишете описание сцены словами, задаёте формат кадра и длительность, получаете готовый ролик. Всё, о чём шла речь в двух предыдущих разделах, — это она.
По совокупности двух арен верхнюю группу занимают Wan 3.0, Gemini Omni Flash, MiniMax H3 и Seedance 2.0. Из них в каталоге GEN202 открыты Seedance 2.0 и линейка Wan 2.7.
Seedance 2.0 делает ролик по описанию, оживляет картинку и работает по образцам, поддерживает разрешения от 480p до 4K, семь форматов кадра и длительность от 4 до 15 секунд. На той же странице лежат два облегчённых уровня — Seedance 2.0 Fast и Seedance 2.0 Mini, оба до 720p, с тем же набором работ. В зачёте Artificial Analysis со звуком строка Dreamina Seedance 2.0 720p стоит пятой с Elo 1221 на 24 692 голосах, а в Arena — четвёртой с 1479 на 51 266 голосах, снимок 2026-08-30 и отсечка 2026-08-25 соответственно. Обе строки собраны на десятках тысяч голосов.
Wan 2.7 в записи для роликов по описанию работает в 720p и 1080p, длительность от 2 до 15 секунд. В зачёте без звука июньская сборка Wan2.7-260612 стоит шестой с Elo 1243, апрельская Wan 2.7 — тринадцатой с 1214, снимок 2026-08-30. В Arena строка wan2.7-t2v стоит пятнадцатой с 1344 на 20 882 голосах.
Kling 3.0 делает ролик и по описанию, и из картинки, форматы кадра 16:9, 9:16 и 1:1, длительность от 3 до 15 секунд. Рядом на той же странице стоят две записи Turbo — для текста и для картинки, обе в 720p и 1080p. В зачёте со звуком старший вариант Kling 3.0 1080p стоит девятым с Elo 1108 на 22 352 голосах, младший 720p — двенадцатым с 1100 на 21 459 голосах.
Veo 3.1 открыт тремя уровнями — обычным, Fast и Lite, каждый в 720p, 1080p и 4K, длительность на выбор 4, 6 или 8 секунд, звук у него включён всегда. В зачёте со звуком обычный вариант стоит пятнадцатым с Elo 1091, Lite — шестнадцатым с 1089, Fast — девятнадцатым с 1086, и все три сняты 2026-08-30. Официальная цена Google за секунду: 0,4 доллара у обычного варианта в 720p и 1080p, 0,6 в 4K, 0,1 и 0,12 у Fast в 720p и 1080p, 0,05 и 0,08 у Lite.
Подробное парное сравнение двух из этих имён вынесено в отдельную статью — Kling или Veo: там разобраны два независимых теста живыми людьми на одинаковых заданиях и официальные заявления разработчиков. Здесь речь про всё поле сразу, и пара оттуда не пересказывается.
Лучшие нейросети для создания видео из фото
Вторая работа начинается с готового изображения: оно служит исходником, а описание задаёт, что в кадре должно произойти. Модель обязана удержать всё, что уже нарисовано, и добавить движение. Сам исходный кадр рисуют другие модели — они разобраны в статье про лучшую нейросеть для изображений. Свой зачёт у этой работы есть у обеих арен.
Данные Artificial Analysis, оживление картинки, зачёт со звуком, снимок 2026-08-30, всего 36 моделей.
| Место | Модель | Разработчик | Elo | Голосов | Цена, $/мин |
|---|---|---|---|---|---|
| 1 | Minimax H3 Max в сборке fal | Fal | 1202 (±9) | 5363 | 2,4 |
| 2 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1190 (±6) | 17 375 | 9,07 |
| 3 | MiniMax H3 | MiniMax | 1185 (±8) | 7233 | 7,8 |
| 4 | Gemini Omni Flash | 1179 (±7) | 12 047 | 6 | |
| 5 | grok-imagine-video-1.5 | SpaceXAI | 1108 (±7) | 6303 | 8,4 |
| 6 | HappyHorse-1.1 | Alibaba-ATH | 1104 (±7) | 13 478 | 9,9 |
| 9 | Veo 3.1 | 1085 (±7) | 8817 | 24 | |
| 11 | Wan 2.7 | Alibaba | 1083 (±7) | 5550 | 9 |
| 16 | Kling 3.0 1080p (Pro) | KlingAI | 1070 (±6) | 16 792 | 20,16 |
| 19 | Kling 3.0 720p (Standard) | KlingAI | 1066 (±6) | 16 727 | 15,6 |
Тот же вопрос в Arena, отсечка голосов 2026-08-25, 1 836 936 голосов, 46 моделей: первое место у minimax-h3 с 1494 на 27 308 голосах, второе у gemini-omni-1.1-flash с 1488, третье у dreamina-seedance-2.5-720p с 1483, четвёртое у dreamina-seedance-2.0-720p с 1477 на 110 372 голосах. Дальше идут grok-imagine-video-1.5-720p с 1459 на 111 667 голосах, wan2.7-i2v с 1427 на 66 184 голосах и kling-v3-pro с 1356 на 180 932 голосах.
Две арены здесь сходятся именами: MiniMax H3, Seedance 2.0 и Gemini Omni Flash стоят в первой четвёрке у обеих.
Голосов в этом зачёте Arena больше, чем в двух других её видеозачётах: 1 836 936 против 645 773 у роликов по описанию при той же отсечке 2026-08-25 и 27 930 у работы с готовым роликом. Чем больше голосов, тем уже доверительные интервалы и тем точнее известен порядок строк.
В каталоге эту работу закрывают четыре записи. У Wan 2.7 это запись image-to-video — 720p и 1080p, от 2 до 15 секунд. У Kling 3.0 таких записей две: Turbo image-to-video в 720p и 1080p с длительностью от 3 до 15 секунд и основная запись, которая принимает и картинку, и текст. Seedance 2.0 с двумя облегчёнными уровнями оживляет картинку в тех же разрешениях, что и генерирует ролик с нуля. Порядок работы с исходным снимком, кадром и длительностью разобран на отдельной странице — оживить фото.
Видео по образцам: свой герой и своя вещь в кадре
Третья работа отличается от первых двух исходником: модели дают не одну картинку, которая станет первым кадром, а набор образцов — лицо человека, предмет, стиль, — и просят собрать новую сцену с ними. Так снимают серию роликов, в которых один и тот же герой или один и тот же товар.
Ближайший к этой работе зачёт — работа с готовым роликом у Arena, отсечка голосов 2026-08-26, 27 930 голосов, 10 моделей: wan3.0 — 1414 при интервале от 1388 до 1440, dreamina-seedance-2.5-720p — 1410, minimax-h3 — 1392, gemini-omni-flash — 1367, dreamina-seedance-2.0-720p — 1365, happyhorse-1.0 — 1307, grok-imagine-video — 1258, kling-o3-pro — 1255, kling-o1-pro — 1197, runway-gen4-aleph — 1182. Голосов в нём 27 930 против 645 773 в зачёте роликов по описанию, а у первой строки на 463 голосах доверительный интервал шириной в 52 пункта — от 1388 до 1440.
В каталоге работа по образцам открыта тремя записями. Запись reference-to-video у Wan 2.7 принимает образцы и собирает ролик в 720p или 1080p длиной от 2 до 10 секунд, форматы кадра 16:9, 9:16, 1:1, 4:3 и 3:4. Seedance 2.0 и оба её облегчённых уровня, Fast и Mini, делают то же самое в своих разрешениях. Kling 3.0 Motion Control решает соседнюю задачу — переносит движение из готового ролика на статичный кадр, работает в 720p и 1080p, официальная цена разработчика от 0,126 до 0,168 доллара за секунду.
Лучшая нейросеть для обработки видео: правка готового ролика
Четвёртая работа начинается с готового ролика: он уже снят или уже сгенерирован, и его надо изменить — заменить фон, убрать предмет, переписать сцену словами. У Artificial Analysis для неё заведён отдельный зачёт, и он самый короткий из всех: девять моделей со звуком и восемь без.
Данные Artificial Analysis, правка ролика, зачёт со звуком, снимок 2026-08-30.
| Место | Модель | Разработчик | Elo | Голосов | Цена, $/мин |
|---|---|---|---|---|---|
| 1 | Wan 3.0 | Alibaba | 1189 (±7) | 5249 | 12 |
| 2 | MiniMax H3 | MiniMax | 1129 (±5) | 12 885 | 7,8 |
| 3 | Gemini Omni Flash | 1124 (±5) | 15 853 | 6 | |
| 4 | HappyHorse-1.0 | Alibaba-ATH | 1088 (±5) | 23 417 | 27,04 |
| 5 | Wan 2.7 | Alibaba | 1077 (±5) | 19 158 | 16,9 |
| 6 | Dreamina Seedance 2.0 720p | ByteDance Seed | 1039 (±5) | 23 239 | 5,57 |
| 7 | Aleph 2.0 | Runway | 1013 (±5) | 20 748 | 16,8 |
| 8 | Kling 3.0 Omni 1080p (Pro) | KlingAI | 1000 (±0) | 18 885 | 10,91 |
| 9 | SkyReels V4 | Skywork AI | 949 (±6) | 15 761 | 37,5 |
Тот же зачёт без звука, снимок той же даты, восемь моделей: Gemini Omni Flash — 1132, Wan 2.7 — 1097, MiniMax H3 — 1093, HappyHorse-1.0 — 1084, Dreamina Seedance 2.0 720p — 1067, SkyReels V4 — 1054, Aleph 2.0 — 1037, Kling 3.0 Omni 1080p — 1000. Wan 2.7 здесь стоит вторым против пятого места в зачёте со звуком.
Цена правки у одной и той же модели отличается от цены генерации. Wan 2.7 на генерации ролика стоит 9 долларов за минуту, а на правке — 16,9. HappyHorse-1.0 на генерации со звуком стоит 13,2, на правке — 27,04.
В каталоге эту работу закрывает запись Video Edit у Wan 2.7: 720p и 1080p, пять форматов кадра, длительность до 10 секунд.
Продление готового ролика
Пятая работа — дописать продолжение к уже готовому ролику, чтобы сцена шла дальше без склейки. Она устроена отдельным вызовом, потому что исходником служит не картинка и не текст, а сам ролик и его последний кадр.
В каталоге продление открыто у Grok Imagine отдельной записью, и счёт по ней идёт за вызов целиком: официальная цена разработчика от 0,36 до 0,8 доллара за генерацию. У Veo 3.1 продление вызывается собственным адресом наравне с генерацией и получением 1080p и 4K, а счёт выставляется за ролик — ставка за секунду умножается на выбранную длительность.
Речь и движение губ под звуковую дорожку
Шестая работа начинается со звука: у вас есть готовая запись голоса и портрет или ролик с человеком, и нужно, чтобы губы двигались под эту запись. Выбор здесь идёт по составу вызова: что модель принимает на вход и в каком разрешении отдаёт результат.
В каталоге на неё стоят две записи. Omnihuman 1.5 делает движение губ под звук, официальная цена разработчика 0,16 доллара за секунду. Infinitalk работает от звуковой дорожки в 480p и 720p, официальная цена от 0,2 до 0,4 доллара за секунду в зависимости от разрешения.
Звук внутри самих видеомоделей — это соседняя работа. Первый зачёт этой страницы собран из моделей, которые делают звуковую дорожку вместе с картинкой, и у Veo 3.1 звук включён всегда. Там звук появляется вместе с роликом, здесь ролик подстраивается под готовую запись.
Лучшие нейросети для улучшения качества видео
Седьмая работа поднимает разрешение готового ролика. В каталоге на неё стоит Topaz video-upscale с увеличением в 1, 2 или 4 раза, официальная цена разработчика 0,08 доллара за секунду.
Второй путь к тому же результату — сразу большое разрешение у самой видеомодели. Seedance 2.0 генерирует в 4K, Veo 3.1 отдаёт 1080p и 4K отдельными вызовами, у Kling 3.0 есть вариант 4K. Что выгоднее в вашем случае, считается по длительности: у Topaz счёт идёт за каждую секунду исходника, а у видеомодели ставка за секунду в 4K выше, чем в 720p.
Сколько стоит минута работы у разработчика
Цены ниже — из данных Artificial Analysis, снимок 2026-08-30, доллары за минуту готового видео. Они относятся к зачёту со звуком, где не отмечено иное.
| Модель | Цена, $/мин | Место в зачёте со звуком |
|---|---|---|
| Agnes-Video-V2.0 | 0,3 | 38 |
| Agnes-Video-2.5 | 1,5 | 21 |
| Minimax H3 Max в сборке fal | 2,4 | 3 |
| LTX-2.3 Fast | 2,4 | 32 |
| Hailuo 2.3 (зачёт без звука) | 2,8 | 43 |
| grok-imagine-video | 4,2 | 25 |
| Veo 3.1 Lite | 4,8 | 16 |
| Gemini Omni Flash | 6 | 2 |
| Sora 2 (декабрьская) | 6 | 14 |
| MiniMax H3 | 7,8 | 4 |
| Wan 2.7 | 9 | 10 |
| Veo 3.1 Fast | 9 | 19 |
| Dreamina Seedance 2.0 720p | 9,07 | 5 |
| HappyHorse-1.1 | 9,9 | 7 |
| Wan 3.0 | 12 | 1 |
| HappyHorse-1.0 | 13,2 | 8 |
| Kling 3.0 720p (Standard) | 15,12 | 12 |
| Kling 3.0 1080p (Pro) | 20,16 | 9 |
| SkyReels V4 | 21 | 11 |
| Veo 3.1 | 24 | 15 |
| Sora 2 Pro | 30 | 22 |
Цена и место в зачёте расходятся. Первое место стоит 12 долларов за минуту, второе — 6, третье — 2,4, а двадцать второе — 30. Самая дорогая строка зачёта, Sora 2 Pro за 30 долларов, стоит на двадцать втором месте из тридцати восьми; самая дешёвая, Agnes-Video-V2.0 за 0,3 доллара, — на тридцать восьмом.
Отсюда следует порядок выбора: сначала берётся группа близких по Elo моделей, а цена сравнивается уже внутри неё. В верхней пятёрке зачёта со звуком разброс цены от 2,4 до 12 долларов за минуту при разнице в 21 пункт Elo.
Ставка за минуту — не единственная единица счёта на рынке. Часть этих же моделей продаётся внутри чужой месячной подписки, где расход считают не минутами, а кредитами тарифа: так устроен Higgsfield, и состав его линейки разобран отдельно — какие модели он раздаёт.
Тем же способом продаёт доступ Luma: Kling 3.0 стоит в её прайсе чужой строкой, а имя, под которым её ищут, у самого сервиса уже снято — разбор на странице Luma Dream Machine. Отдельно от этого ряда стоит HeyGen: чужих моделей в его прайсе нет ни одной, а работа у него своя — ролик с говорящим аватаром и перевод готового видео (что он умеет).
Скорость: сколько времени занимает одна генерация
Artificial Analysis замеряет медианное время генерации у каждого провайдера отдельно и публикует его рядом с ценой. Снимок 2026-08-30, колонка Elo относится к зачёту роликов по описанию без звука.
| Модель | Провайдер | $/мин | Elo | Медианное время, с |
|---|---|---|---|---|
| MiniMax H3 | MachGen | 2,4 | 1301 | 6 |
| MiniMax H3 | fal.ai | 3,6 | 1301 | 9 |
| Veo 2 | 30 | 1113 | 21 | |
| LTX-2.3 Fast | fal.ai | 2,4 | 1120 | 31 |
| Seedance 1.0 | BytePlus | 7,32 | 1135 | 45 |
| Seedance 1.5 pro | BytePlus | 5,93 | 1170 | 57 |
| Kling 3.0 720p (Standard) | fal.ai | 10,08 | 1212 | 65 |
| Kling 3.0 Omni 720p (Standard) | fal.ai | 10,08 | 1213 | 73 |
| Hailuo 2.3 | MiniMax | 2,8 | 1169 | 86 |
| Wan 2.5 Preview | fal.ai | 9 | 1158 | 111 |
| HappyHorse-1.1 | Alibaba Cloud | 9,9 | 1262 | 118 |
| Kling 3.0 1080p (Pro) | fal.ai | 13,44 | 1238 | 119 |
| Sora 2 Pro | OpenAI | 30 | 1180 | 123 |
| HappyHorse-1.0 | Alibaba Cloud | 13,2 | 1283 | 149 |
Одна и та же модель у разных провайдеров работает по-разному, и это видно в таблице напрямую: MiniMax H3 у MachGen отдаёт результат за 6 секунд при цене 2,4 доллара за минуту, а у Runware — за 126 секунд при цене 5,5 доллара за минуту. Модель одна, замеры разные.
Разрешение тоже стоит времени: Kling 3.0 в 720p замерен на 65 секундах, в 1080p — на 119, у одного и того же провайдера.
Лучшие китайские нейросети для видео
В верхней части обеих арен стоят модели китайских разработчиков: Alibaba, Alibaba-ATH, ByteDance Seed, MiniMax, KlingAI от Kuaishou, Vidu, Tencent. Рядом с ними в тех же строках идут Google, OpenAI и SpaceXAI.
Alibaba. Wan 3.0 — первая строка зачёта со звуком с Elo 1242 и первая строка правки ролика с Elo 1189, снимок 2026-08-30. Wan 2.7 идёт двумя сборками: июньской, шестое место в зачёте без звука с Elo 1243, и апрельской, тринадцатое место с 1214. HappyHorse от подразделения Alibaba-ATH выходит двумя версиями: 1.1 стоит седьмым в зачёте со звуком с Elo 1145, 1.0 — третьим в зачёте без звука с 1283.
ByteDance. Dreamina Seedance 2.0 720p — пятое место в зачёте со звуком с Elo 1221 на 24 692 голосах и второе место в оживлении картинки с 1190. В Arena рядом с ней стоит отдельная строка Seedance 2.5 с Arena score 1476 на роликах по описанию и 1483 на оживлении картинки, отсечка голосов 2026-08-25.
MiniMax. H3 стоит четвёртым в зачёте со звуком с Elo 1227 и вторым в зачёте без звука с 1301, а сборка Minimax H3 Max, дообученная площадкой fal, — третьей и первой соответственно в двух зачётах. Линейка Hailuo идёт ниже, но дешевле: Hailuo 2.3 при Elo 1169 в зачёте без звука стоит 2,8 доллара за минуту.
Kuaishou. Kling 3.0 представлен четырьмя строками: 1080p и 720p, обычный и Omni. Старший вариант стоит девятым в зачёте со звуком с Elo 1108 на 22 352 голосах, а в Arena строка kling-v3-pro на оживлении картинки набрала 1356 на 180 932 голосах.
Модели с открытыми весами
Открытые веса — это когда модель выложена так, что её можно скачать и запустить на своём оборудовании, а лицензия рядом с ней говорит, на каких условиях это разрешено. Какие из этих моделей выложены именно так, видно в колонке лицензии у Arena, снимок с отсечкой голосов 2026-08-25: у minimax-h3 своя общественная лицензия, у wan-v2.2-a14b — Apache 2.0, у kandinsky-5.0-t2v-pro и kandinsky-5.0-t2v-lite — MIT, у ltx-2-19b и hunyuan-video-1.5 — общественные лицензии их разработчиков, у mochi-v1 — Apache 2.0.
Artificial Analysis выделяет этот разрез отдельной формулировкой, снятой 2026-08-30: среди моделей с открытыми весами в зачёте роликов по описанию со звуком ведёт MiniMax H3 с Elo 1227, за ним LTX-2.5 Pro с 1061 и LTX-2.5 Fast с 1059.
Между MiniMax H3 и первым местом того же зачёта, Wan 3.0, — 15 пунктов Elo. Это меньше, чем расстояние между четвёртым и шестым местом той же таблицы.
VBench: что показывает автоматический зачёт
Автоматический зачёт считает не голоса людей, а метрики: согласованность объекта и фона, плавность движения, эстетику, соответствие тексту. Из них складываются три числа, подписанные у источника по-английски: Quality Score — качество самой картинки, Semantic Score — совпадение ролика с запросом, Total Score — общий итог из первых двух. Страница снята 2026-08-30, у каждой строки своя дата записи результата.
| Модель | Дата записи | Total Score | Quality Score | Semantic Score |
|---|---|---|---|---|
| HiDream-O1-Video | 2026-08-07 | 89,74% | 89,43% | 90,99% |
| IPOW | 2025-08-06 | 88,26% | 87,83% | 90,01% |
| Vidu Q1 | 2025-04-21 | 87,41% | 87,28% | 87,94% |
| Wan2.1 | 2025-02-24 | 86,22% | 86,67% | 84,44% |
| Veo 3 | 2025-08-06 | 85,06% | 85,70% | 82,49% |
| Wan2.2-T2V-A14B с подготовкой запроса | 2026-02-18 | 84,23% | 85,42% | 79,50% |
| Kling 1.6 | 2025-05-08 | 83,40% | 85,00% | 76,99% |
Всего в таблице источника 73 строки, и самая свежая из них датирована 2026-08-07. Закрытых моделей 2026 года — Kling 3.0, Seedance 2.0, Veo 3.1, Sora 2, Hailuo — в ней нет: попадают туда только те, кого кто-то прогнал по открытому коду зачёта и прислал результат. Поэтому строки выше читаются как история вопроса и как описание того, что автоматика вообще умеет мерить, а не как ответ на вопрос о сегодняшнем выборе.
Вторая версия зачёта, VBench-2.0, меряет другое, и её колонки тоже подписаны по-английски: Creativity — выдумка, Commonsense — бытовая правдоподобность, Controllability — послушность запросу, Human Fidelity — достоверность человека в кадре, Physics — правдоподобность движения предметов. В ней 12 строк, и самая свежая записана 2026-04-01 — это старше полугода на дату снимка, и место этих чисел тоже в истории. Первую строку там занимает Veo 3 с Total 66,72% и записью от 2025-09-04, дальше JT-CV с 64,60%, ABot-World v0.1 с 64,47%.
Третья таблица, VBench-I2V, оценивает оживление картинки: 35 строк, самая свежая от 2026-05-20. Наверху DreamX-World-1.0 с Total 90,49% при I2V Score 97,74% — эта колонка показывает, насколько готовый ролик остался верен исходной картинке, дальше ToMoviee-2.0 с 89,76% и Steamer-I2V с 89,38%. Сборки Wan 2.2 стоят там же: Wan2.2-TI2V-5B с подготовкой запроса — 88,80%, Wan2.2-I2V-A14B — 88,68%.
Отдельная история — Movie Gen Bench от Meta. Компания выложила 1003 запроса и собственные ролики вместе со статьёй arXiv 2410.13720, поданной 2024-10-17, и привела победные доли своей модели против чужих: против Kling 1.5 по общему качеству 3,87 процентного пункта при погрешности ±5,07, против Sora — 8,23. Сравнение организовала сама Meta и опубликовала его в собственной статье: это заявление разработчика о своей модели, а не независимый замер. Плюс данные почти двухлетней давности: моделей, о которых говорит эта страница, тогда не существовало.
Сводная таблица: что под какую работу
Числа в средней колонке — это Elo, оценка из слепых голосов зрителей: чем выше, тем чаще выбирали ролик этой модели. Сравнивать их можно только внутри одной строки, потому что у каждого зачёта своя шкала.
| Работа | Кто наверху в зачёте | Что открыто в каталоге GEN202 |
|---|---|---|
| Ролик по описанию со звуком | Wan 3.0 — Elo 1242, Gemini Omni Flash — 1237 (Artificial Analysis, 2026-08-30) | Kling 3.0, Seedance 2.0, Veo 3.1 |
| Ролик по описанию без звука | Gemini Omni Flash — 1324, MiniMax H3 — 1301 (Artificial Analysis, 2026-08-30) | Wan 2.7, Kling 3.0 Turbo, Seedance 2.0 Fast |
| Оживление картинки | Minimax H3 Max в сборке fal — 1202, Seedance 2.0 — 1190 (Artificial Analysis, 2026-08-30) | Wan 2.7, Kling 3.0 в записи Turbo image-to-video, Seedance 2.0 |
| Видео по образцам | wan3.0 — 1414, seedance-2.5 — 1410 (Arena, отсечка 2026-08-26) | Wan 2.7 в записи reference-to-video, Seedance 2.0, Kling 3.0 Motion Control |
| Правка готового ролика | Wan 3.0 — 1189, MiniMax H3 — 1129 (Artificial Analysis, 2026-08-30) | Wan 2.7 в записи Video Edit |
| Продление ролика | выбор по входу: исходный ролик и его последний кадр | Grok Imagine, Veo 3.1 отдельным вызовом |
| Губы под звуковую дорожку | выбор по входу: готовая звуковая дорожка и разрешение | Omnihuman 1.5, Infinitalk |
| Увеличение разрешения | выбор по кратности увеличения и длительности исходника | Topaz video-upscale, генерация сразу в 4K у Seedance 2.0 и Veo 3.1 |
| Самая низкая цена минуты в верхней пятёрке | Minimax H3 Max в сборке fal — 2,4 $/мин (Artificial Analysis, 2026-08-30) | Seedance 2.0 Mini как младший уровень на странице Seedance 2.0 |
Таблица читается по строкам: под три разные работы здесь выходят три разных ответа, и это нормальный результат сравнения, а не противоречие внутри него.
Цена секунды у тех же моделей в GEN202
Все видеомодели каталога работают по одному ключу, счёт идёт рублями с карты российского банка, и оплата за границу в валюте для этого не нужна.
Секунда Kling 3.0 без звука стоит 7,6 ₽ в 720p и 10,1 ₽ в 1080p; со звуком — 11,3 ₽ и 15,1 ₽, а вариант 4K — 37,8 ₽. У Kling 3.0 Turbo для текста секунда стоит 10,1 ₽ в 720p и 12,6 ₽ в 1080p, у варианта Turbo для картинки — 10,1 ₽ и 12,6 ₽.
У Seedance 2.0 секунда ролика по описанию стоит 12,7 ₽ в 480p, 27,2 ₽ в 720p, 61,2 ₽ в 1080p и 140,4 ₽ в 4K. Когда исходником служит готовый ролик, ставка ниже: 16,3 ₽ за секунду в 720p. У Seedance 2.0 Fast те же 720p стоят 21,8 ₽ за секунду, у Seedance 2.0 Mini — 13,9 ₽, а 480p у Mini — 6,5 ₽.
Вся линейка Wan 2.7 считается одинаково: 9 ₽ за секунду в 720p и 13,5 ₽ в 1080p — и у оживления картинки, и у работы по образцам, и у правки готового ролика. Секунда Kling 3.0 Motion Control стоит 11,3 ₽ в 720p и 15,1 ₽ в 1080p. Цены Veo 3.1 собраны таблицей на его карточке: там разложены обычный уровень, Fast и Lite по трём разрешениям, потому что у Google разница между ними кратная.
Цена каталога ниже официальной цены разработчика: у большинства видеозаписей ровно на десять процентов, и считается разница по каждому варианту отдельно. Весь список видеомоделей с ценами и полями запроса собран на странице каталог видеомоделей, сводка по видам работы — на странице цен.
При регистрации на счёт приходит 50 кредитов (25 ₽), дальше пополнение идёт от 500 ₽. Голоса в аренах собраны на чужих сюжетах, а ваш сюжет свой: один и тот же сценарий отправляется в две-три модели подряд, и результаты видно рядом. Отправить запрос словами можно в чате: сценарий пишется сообщением, а разрешение, формат кадра и длительность задаются переключателями. Порядок работы с запросом и образцом разобран отдельно — как пользоваться Kling, как пользоваться Seedance, как пользоваться Veo и как пользоваться Wan. Общий обзор моделей и задач — на странице нейросеть для видео. Ответ по остальным задачам — тексту, картинкам, коду и русскому языку — собран в разборе лучшая нейросеть.
Частые вопросы
Какая нейросеть лучшая для видео?
Ответ зависит от работы, и это видно по числам. В зачёте роликов по описанию со звуком у Artificial Analysis на 2026-08-30 первая строка — Wan 3.0 с Elo 1242. В том же зачёте без звука первая строка другая — Gemini Omni Flash с 1324. На оживлении картинки со звуком наверху Minimax H3 Max в сборке fal с 1202, а в Arena на той же работе — minimax-h3 с 1494 при отсечке голосов 2026-08-25. На правке готового ролика снова Wan 3.0 с 1189. Выбирать стоит по своей работе и по цене внутри группы близких моделей: в верхней пятёрке зачёта со звуком разброс цены от 2,4 до 12 долларов за минуту при разнице всего в 21 пункт Elo.
Какая лучшая нейросеть для создания видео из фото?
По зачёту оживления картинки Artificial Analysis со снимком 2026-08-30 первые четыре строки заняли Minimax H3 Max в сборке fal с Elo 1202, Dreamina Seedance 2.0 720p с 1190, MiniMax H3 с 1185 и Gemini Omni Flash с 1179. Arena с отсечкой голосов 2026-08-25 на 1 836 936 голосах ставит наверх minimax-h3 с 1494, gemini-omni-1.1-flash с 1488 и dreamina-seedance-2.5-720p с 1483. Обе арены ставят в первую четвёрку одни и те же имена. Из каталога сюда подходят Wan 2.7 в записи image-to-video, Kling 3.0 в записи Turbo image-to-video и Seedance 2.0 с двумя облегчёнными уровнями.
Лучшая нейросеть для видео 2026 — как понять, что список не устарел?
По датам снимков. У каждой таблицы на этой странице стоит своя: у зачётов Artificial Analysis это 2026-08-30, дата забора данных, потому что собственную дату пересчёта источник не публикует; у Arena — момент отсечки голосов, который источник публикует сам: 2026-08-25 для роликов по описанию и оживления картинки, 2026-08-26 для работы с готовым роликом. Проверить свежесть можно самостоятельно: обе арены открыты, адреса указаны в разделе про методику, и строки в них меняются вместе с новыми голосами.
Какая нейросеть лучше всего генерирует видео со звуком?
Зачёт моделей со звуком у Artificial Analysis на 2026-08-30 ведёт Wan 3.0 с Elo 1242 на 6254 голосах. За ним идут Gemini Omni Flash с 1237 на 17 933 голосах и Minimax H3 Max в сборке fal с 1235 на 5342 голосах. Из моделей каталога в этом зачёте выше всех стоит Dreamina Seedance 2.0 720p — пятое место с Elo 1221 на 24 692 голосах. У Veo 3.1 звук включён всегда и не отключается, его строка в этом зачёте пятнадцатая с Elo 1091.
Лучшие нейросети для редактирования видео — что выбрать?
Зачёт правки готового ролика у Artificial Analysis самый короткий из всех: девять моделей со звуком и восемь без. На 2026-08-30 со звуком наверху Wan 3.0 с Elo 1189, MiniMax H3 с 1129 и Gemini Omni Flash с 1124; без звука порядок другой — Gemini Omni Flash с 1132, Wan 2.7 с 1097, MiniMax H3 с 1093. В каталоге эту работу закрывает запись Video Edit у Wan 2.7 в 720p и 1080p с длительностью до 10 секунд, а перенос движения из готового ролика на статичный кадр — Kling 3.0 Motion Control.
Лучшие нейросети для оживления видео и старых кадров?
Оживление начинается с изображения, и работает здесь тот же зачёт, что и у создания видео из фото: наверху Minimax H3 Max в сборке fal, Seedance 2.0 и MiniMax H3 по снимку Artificial Analysis от 2026-08-30. Практическая сторона разобрана на отдельной странице — оживить фото, где показан порядок работы с исходным снимком, форматом кадра и длительностью.
Чем эта страница отличается от сравнения Kling и Veo?
Здесь всё поле видеомоделей по числам двух арен и разбор по семи работам. В статье Kling или Veo разобрана одна пара и другой тип источника: два независимых теста живыми людьми на одинаковых заданиях, с цитатами авторов и официальными заявлениями разработчиков. Страницы дополняют друг друга: арены показывают порядок на большой выборке голосов, а разбор пары — что происходит с конкретными сюжетами.
Что показывает VBench и почему его чисел мало на этой странице?
VBench считает метрики автоматически, без голосов людей, по открытому коду: любой может прогнать модель и прислать результат. Из-за этого в таблице оказываются только те модели, которые кто-то прогнал: закрытых моделей 2026 года — Kling 3.0, Seedance 2.0, Veo 3.1, Sora 2, Hailuo — там нет. Самая свежая строка VBench 1.0 записана 2026-08-07, у второй версии зачёта самая свежая строка датирована 2026-04-01. Поэтому VBench на этой странице стоит как история вопроса и как описание того, что умеет мерить автоматика.
Лучшие китайские нейросети для видео — какие они?
Они занимают большую часть верхних строк обеих арен. Wan 3.0 от Alibaba — первое место в зачёте со звуком с Elo 1242 и в правке ролика с 1189. Dreamina Seedance 2.0 720p от ByteDance — пятое место в зачёте со звуком с 1221 и второе в оживлении картинки с 1190. MiniMax H3 — четвёртое место со звуком с 1227 и второе без звука с 1301. HappyHorse 1.1 от Alibaba-ATH — седьмое место со звуком с 1145. Kling 3.0 от Kuaishou — девятое место со звуком с 1108, а в Arena его строка на оживлении картинки собрала 180 932 голоса. Все числа сняты 2026-08-30 у Artificial Analysis и с отсечкой голосов 2026-08-25 у Arena.
Чат с нейросетью онлайн
Kling, Seedance, Wan и другие нейросети — в одном окне, прямо в браузере. Выберите нужную в списке над полем ввода и опишите сцену словами: первая работа идёт за счёт сервиса. Больше моделей и история разговоров — в чате с нейросетью.