Wan 3.0 - свежее поколение видеомодели Alibaba: ролики до 30 секунд со звуком, разрешение до 1080p и 30 кадров в секунду. Публичная бета открылась 6 августа 2026, полный релиз состоялся 24 августа. Ниже - что изменилось против Wan 2.7 и 2.6, что модель принимает на вход, сколько стоит секунда и чем её заменить, если нужен доступ из России
Семейство Wan известно тем, что открытые поколения можно было запускать на своей машине. Третья версия сместила акцент: она стала мощнее и универсальнее, но ушла в облако. Разберём по фактам, что это даёт на практике
- Wan 3.0 - видеомодель лаборатории Tongyi (Alibaba), полный релиз 24 августа 2026, бета с 6 августа
- Длительность выросла с 15 до 30 секунд, разрешения 480p, 720p и 1080p, частота 30 кадров в секунду
- Звук генерируется вместе с картинкой: диалоги, фоновая музыка и эффекты
- Вход стал шире: текст, картинки, видео и аудио, а также документы DOC, XLS, PPT, PDF и веб-страницы
- Цена посекундная: примерно 0,05 / 0,10 / 0,20 доллара за секунду для 480p, 720p и 1080p
- Локально не запускается: открытых весов на конец августа 2026 нет, локально работают прошлые поколения 2.1 и 2.2
- Из России удобнее брать доступные Seedance 2.5, Kling 3.0, Veo 3.1 и Hailuo 3 по подписке с оплатой картой РФ
Что такое Wan 3.0
Wan - семейство видеомоделей, которое развивает лаборатория Tongyi компании Alibaba. Линейка известна с версии 2.1: её открытые веса разошлись по локальным сборкам и сделали Wan рабочей лошадкой тех, кто генерирует видео на своём железе, без облака и подписок
Третья версия вышла в публичную бету 6 августа 2026, полный релиз состоялся 24 августа. Главная идея поколения - единая архитектура: вместо набора отдельных режимов под текст, картинку и референсы модель собрана как один универсальный движок, который принимает разные типы входных данных и отдаёт готовый ролик со звуком
Что нового против Wan 2.7 и 2.6
Чтобы понять масштаб шага, полезно вспомнить, как семейство росло за последний год. Wan 2.6 вышла в декабре 2025 и принесла 1080p, ролики до 15 секунд, точный липсинк, загрузку собственного аудио и автоматическую разбивку результата на планы с логикой переходов. Wan 2.7 появилась 3 апреля 2026: она добавила контроль первого и последнего кадра, а также синхронизацию движения с загруженной музыкой или речью
Wan 3.0 работает по трём направлениям сразу
- Длительность. Предел вырос с 15 до 30 секунд. Это уже не короткая склейка, а полноценная сцена, которую не приходится собирать из кусков
- Единая архитектура. Задачи объединены в одной модели, а не разнесены по отдельным режимам, поэтому один и тот же ролик можно вести от текста к референсам без пересборки замысла
- Расширенный вход. Кроме текста, картинок, видео и аудио модель принимает документы и веб-страницы, то есть исходником может быть презентация или страница товара
Характеристики и входные форматы
Сводка по поколениям, чтобы видеть разницу одним взглядом
| Параметр | Wan 2.6 | Wan 2.7 | Wan 3.0 |
|---|---|---|---|
| Выход | декабрь 2025 | апрель 2026 | август 2026 |
| Длительность | до 15 секунд | до 15 секунд | до 30 секунд |
| Разрешение | 1080p | 1080p | 480p, 720p, 1080p |
| Звук | своё аудио, липсинк | синхрон движений с музыкой | диалоги, музыка, эффекты |
| Особенность | монтаж по планам | первый и последний кадр | единая архитектура |
| Локальный запуск | нет | нет | нет, только облако |
По входным данным Wan 3.0 работает в трёх привычных режимах: из текста, из картинки и из референсов. Reference-режим держит до 10 изображений, 5 видео и 5 аудиофайлов одновременно, то есть персонажа, стиль и звук можно задавать примерами, а не описанием. Отдельная строчка - документы: DOC, XLS, PPT, PDF и веб-страницы, из которых модель вытаскивает содержание для ролика
Частота 30 кадров в секунду означает, что видео на выходе идёт плавно и не требует отдельной интерполяции. Разрешение выбирается под задачу: 480p достаточно для черновиков и проверки идеи, 1080p - для финального ролика
Цены и локальный запуск
Тарификация посекундная: примерно 0,05 доллара за секунду в 480p, 0,10 в 720p и 0,20 в 1080p, на старте продаж действовала скидка 30 процентов до 24 сентября 2026. Считать удобно от финального ролика: тридцать секунд в 1080p выходят около 6 долларов по полной цене, и это без учёта неудачных дублей, которых на практике всегда несколько
Отдельный момент для тех, кто пришёл в Wan ради открытых весов. На конец августа 2026 весов и полноценного кода для локального запуска третьей версии не публиковали: модель живёт в облаке. Локально по-прежнему запускаются предыдущие открытые поколения, включая Wan 2.1 и 2.2, но их качество и длительность уже заметно отстают от свежих облачных моделей
Кому подойдёт, а кому нет
Модель сильна там, где нужна длинная сцена со звуком в один проход, и слабее там, где важны цена ошибки и предсказуемость
- Подойдёт для рекламных роликов и презентаций. Полминуты со звуком закрывают формат целиком, а вход из документа и веб-страницы экономит подготовку
- Подойдёт для сцен с речью. Диалоги и липсинк собираются вместе с картинкой, отдельная озвучка и синхронизация не нужны
- Спорно для перебора идей. Посекундная цена наказывает за дубли: черновики дешевле гонять в 480p или в других моделях
- Не подойдёт для локальной работы. Если нужен запуск на своём железе, актуальны прошлые открытые поколения, а не третье
- Не подойдёт, если важна оплата картой РФ. Облачный доступ Alibaba оплачивается зарубежной картой, поэтому из России чаще идут через агрегатор с другими моделями
Чем заменить: доступные альтернативы
Задачи, ради которых берут Wan 3.0, закрываются и другими видеомоделями, до которых из России дойти проще
| Задача | Чем заменить | Почему |
|---|---|---|
| Кинематографичная сцена | Seedance 2.5 | Держит плавное движение камеры и композицию кадра |
| Оживить фото | Kling 3.0 | Аккуратная анимация по одному изображению |
| Видео со звуком | Veo 3.1 | Хорошо связывает движение в кадре со звуком |
| Динамика и экшен | Hailuo 3 | Сильна в резком движении и коротких динамичных сценах |
| Правки на готовом видео | Omni Flash | Работает по вашему ролику, а не генерирует с нуля |
Практический подход: черновик собирают в одной модели, а финал перегенерируют там, где результат вышел ближе к замыслу. Сравнение двух самых ходовых разобрано в статье Kling 3.0 против Seedance, а общий разбор выбора - в гиде как выбрать нейросеть под задачу
Как сделать ИИ-видео из России
Держать отдельную зарубежную подписку под каждую видеомодель дорого и неудобно. Syntax AI (Синтакс АИ) даёт доступ к Seedance 2.5, Kling 3.0, Veo 3.1, Hailuo 3 и ещё 100+ нейросетям для видео, картинок, звука и текста по одной подписке, работает из России и принимает карты РФ через СБП и МИР
Честно про деньги: регистрация бесплатна, пробных токенов хватает попробовать генерацию картинок, а видео расходует заметно больше - под ролики нужен платный пакет. Токены не сгорают, поэтому сцену можно доводить постепенно. Что входит в пакеты - на странице тарифы Syntax AI
Запуск - на сайте в браузере или в Telegram-боте со смартфона. Удобный сценарий: один и тот же промпт прогнать в Seedance 2.5, Kling 3.0 и Veo 3.1 и выбрать, чья версия сцены ближе к задуманному, не заводя три разных аккаунта и способа оплаты