• Виктор
  • Блог
  • 3 мин. чтения

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики


Alibaba официально запустила Wan3.0 – видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и обычных офисных файлов. Презентацию, отчёт или веб-страницу можно отдать модели целиком и получить готовое видео. Запуск состоялся 24 августа.

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Wan – линейка видеомоделей Alibaba , которую компания развивает с 2025 года и держит в своём облаке. Третье поколение подаётся под лозунгом «видео из чего угодно», потому что кроме текстового запроса модель принимает готовые рабочие файлы. В открытом предварительном доступе Wan3.0 провёл чуть больше двух недель, с 6 августа. Работать с ним можно через Alibaba Cloud Model Studio и Qwen Cloud по идентификатору wan3.0-video, а потребительский сайт wan.video пока открыт только для участников программы.

Презентация на входе, ролик на выходе

От привычных text-to-video генераторов Wan3.0 отличает приём документов. Модель читает DOC, XLS, PPT, PDF, TXT и Markdown, понимает форматы Apple Keynote, Pages и Numbers, принимает ссылку на веб-страницу и собирает по ним видеоряд. Квартальный отчёт становится видеосводкой, обучающий модуль – мини-курсом, рекламная презентация – роликом для соцсетей.

Аппетит у Wan3.0 при этом умеренный. За один запрос принимается один файл или одна ссылка, до 100 МБ и до 50 страниц. Годовой отчёт на две сотни страниц целиком не зайдёт.

Такой вход переводит Wan3.0 из разряда «красивая пятисекундная заставка» в разряд производственного инструмента. Материал для ролика у компании обычно уже лежит в файловом хранилище и до сих пор требовал монтажёра.

Тридцать секунд и десять картинок

Предельная длина ролика у Wan3.0 – 30 секунд за одну генерацию, без склейки из кусков. Это вдвое больше, чем у прошлого поколения Wan2.7. Разрешение на выбор – 480p, 720p или 1080p. За один запрос модель принимает сразу несколько источников:

  • текстовый промпт;
  • до 10 изображений;
  • до 5 видеофрагментов;
  • до 5 аудиодорожек;
  • документ или ссылку на веб-страницу.

Платформа подсказывает оптимальную длительность под сюжет и умеет продолжать готовый ролик.

Лицо героя не плывёт между сценами

Главный акцент Alibaba делает на согласованности. Wan3.0 удерживает внешность персонажа, вид товара, планировку пространства, единый стиль и голос от сцены к сцене – то самое место, где генеративное видео обычно рассыпается. Отдельно компания заявляет о разнообразии лиц и более живой мимике, независимых замеров пока нет.

Звук Wan3.0 выдаёт синхронно с картинкой, вместе с речью, музыкой и эффектами, озвучка мультиязычная. Второй практичный момент – точечные правки. Поменять изображение, реплику или поворот сюжета можно без полной перегенерации, что для тридцатисекундного ролика экономит и время, и деньги.

Вчетверо дешевле Veo 3.1

Стоимость доступа к Wan3.0 через API считается посекундно. В базовом тарифе выходит так:

  • 480p – $0,05 за секунду, $1,50 за тридцатисекундный ролик;
  • 720p – $0,10 и $3 соответственно;
  • 1080p – $0,20 и $6.

Есть и тариф Prime с более быстрой генерацией, где те же секунды идут по $0,068, $0,14 и $0,28. С 24 августа по 23 сентября Alibaba держит на базовом тарифе скидку 30%.

Google Veo 3.1 в базовой версии просит около $0,40 за секунду, вчетверо больше, чем Wan3.0 в максимальном качестве. Ценовая агрессия объяснима. Релиз вышел следом за размещением акций почти на $10 млрд, и эти деньги идут в ИИ-инфраструктуру.

Текст в кадре пока хромает

Слабые места Alibaba называет сама. Качество надписей внутри кадра и качество звука в Wan3.0 компания признаёт требующими доработки. Для модели, которую продают как конвертер презентаций в видео, признание неудобное, потому что в презентации текст и есть основное содержание.

Пока надёжнее готовить титры и озвучку отдельно, а Wan3.0 отдавать только видеоряд.

Три двери в Wan3.0

Попробовать Wan3.0 без корпоративного контракта можно тремя путями. Первый – сайт wan.video и его генератор, вход через Google или GitHub. Доступ там пока по членству, с очередью и лимитами, но несколько роликов новичку обычно дают.

Дальше идут Alibaba Cloud Model Studio и Qwen Cloud. Новым аккаунтам дают стартовую бесплатную квоту, заметнее всего в сингапурском регионе. Взамен нужен аккаунт Alibaba Cloud с верификацией, а консоль рассчитана на разработчика.

Самый короткий путь – сторонние онлайн-генераторы видео, которые уже подключили Wan3.0. Там она идёт по кредитам, часть сервисов раздаёт стартовый пакет бесплатно. Приём документов появляется у них не сразу, так что PDF и презентации стоит проверить до оплаты.

Статья превращается в короткий ролик

Владельцам сайтов и авторам Wan3.0 интересен как дешёвый способ получить видеоверсию текста. Материал отдаётся модели ссылкой, на выходе вертикальный ролик под соцсети. Первые пробы дешевле гонять по 5–10 секунд в 480p. Десять роликов по 15 секунд в 720p – это 150 секунд генерации, около $15.

Открытые веса остались в Wan2.2

Репутацию линейке Wan сделали открытые версии. Wan2.1 и Wan2.2 выходили под лицензией Apache 2.0, их можно было скачать и запустить на своём железе, и именно это собрало вокруг модели сообщество энтузиастов. Начиная с Wan2.5 линейка закрылась, и за год смены версий наружу больше ничего не вышло.

Судить об успехе релиза стоит по тому, появится ли открытая сборка третьего поколения ближе к зиме. Если её не будет, Wan окончательно переезжает в разряд обычных облачных сервисов, где спорят ценой за секунду. По этой цене Wan3.0 пока спорит убедительно.


Ниже то, что у меня получилось сгенерировать с Wan 3.0 загрузив эту новость текстом 😂



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Anthropic выпустила Claude Opus 5.5 – уровень Fable за меньшие деньги

Anthropic выпустила Claude Opus 5.5, первую модель нового поколения Claude 5.5. По заявлению компании, на большинстве задач она...

Suno вводит лимиты на скачивание — до 7 треков бесплатно

Suno объявила, что с 3 сентября введёт лимиты на скачивание созданной музыки. На бесплатном тарифе пользователи, зарегистрировавшиеся до...

ImagineArt показала модель 2.0

ImagineArt представила модель ImagineArt 2.0 и делает ставку на то, что в генерации изображений пользователям важен уже не...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Midjourney V8.1 ускорилась и вернула стиль

Midjourney выпустила альфа-версию V8.1, в которой разработчики сделали ставку на баланс: вернули фирменный визуальный стиль, ускорили генерацию и...

Alibaba выложила Qwen-Image-2.1 – картинки с прозрачным фоном из коробки

Команда Qwen выложила в открытый доступ Qwen-Image-2.1 - модель, которая рисует изображения сразу с прозрачным фоном и правит...

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Гайд по размерам для YouTube: шапка канала, обложка видео, Shorts, аватар, лого

Если вы загружаете ролики на YouTube и оформляете канал, размеры лучше определить заранее. Иначе шапка обрежется на смартфоне,...

Apple ведёт переговоры с издателями о выплатах за актуальные новости для Siri

Согласно информации The Wall Street Journal, Apple ведёт переговоры о выплатах издателям за использование их контента для работы будущего...

Скоро выйдет Veo 3.1? Обещают стабильных персонажей и киношные пресеты

На платформе WaveSpeedAI появился тизер будущего релиза Google Veo 3.1. Судя по описанию, новое поколение видеомодели решит главную...

OpenAI стандартизировала отчёты об отклонениях и скрытом поведении ИИ-моделей

OpenAI представила фреймворк для отчётов о рассогласовании моделей (Model Misalignment Reporting Framework). Компания стандартизировала сбор данных об опасных...

Нейросеть для сложных расчётов: чек-лист для новичка

Недавно нейросеть Claude посчитала физическую задачу, с которой годами возились специалисты — расчёт на девять петель в квантовой...

Qwen выпустила плагины Qwen-MM для мультимодальных ИИ-агентов

Команда Qwen опубликовала Qwen-MM-Plugins — набор открытых плагинов для работы ИИ-агентов с изображениями, видео и документами. Репозиторий поддерживает...

Проверка текста нейросетью: частые ошибки новичков

Люди приходят к нейросети с текстом так же, как раньше несли его редактору: «вот, посмотри, всё ли нормально»....

ElevenLabs запустила Flows Agent в ElevenCreative — агент строит workflow по текстовому запросу

ElevenLabs представила Flows Agent в ElevenCreative. Пользователь описывает, что хочет создать, а ИИ-агент подбирает модели, добавляет узлы на...

Килиан Мбаппе ушёл от Nike и стал амбассадором бренда On

Швейцарский производитель спортивной одежды и обуви On заключил контракт с нападающим «Реала» и сборной Франции Килианом Мбаппе. Футболист...

Sakana Fugu: ИИ, который учится управлять другими ИИ

22 июня 2026 года японская лаборатория Sakana AI (Токио) представила свой новый коммерческий продукт под названием Sakana Fugu....

Яндекс сводит аналитику данных в одну платформу

Yandex B2B Tech анонсировала DataLens Platform, платформу для работы с корпоративными данными от загрузки и хранения до отчётов...

OpenAI выпустила приложение Sora на Android — пока только в 7 странах

OpenAI представила Android-версию приложения Sora — инструмента для генерации коротких видео с помощью искусственного интеллекта. Скачать ИИ-генератор видео...

MiniMax выпустила видеомодель H3 – ролики в 2K со звуком

MiniMax 31 июля представила H3 - мультимодальную видеомодель, которая принимает текст, изображения, видео и звук и выдаёт ролики...