• Виктор
  • Блог
  • 3 мин. чтения

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики


Alibaba официально запустила Wan3.0 – видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и обычных офисных файлов. Презентацию, отчёт или веб-страницу можно отдать модели целиком и получить готовое видео. Запуск состоялся 24 августа.

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Wan – линейка видеомоделей Alibaba , которую компания развивает с 2025 года и держит в своём облаке. Третье поколение подаётся под лозунгом «видео из чего угодно», потому что кроме текстового запроса модель принимает готовые рабочие файлы. В открытом предварительном доступе Wan3.0 провёл чуть больше двух недель, с 6 августа. Работать с ним можно через Alibaba Cloud Model Studio и Qwen Cloud по идентификатору wan3.0-video, а потребительский сайт wan.video пока открыт только для участников программы.

Презентация на входе, ролик на выходе

От привычных text-to-video генераторов Wan3.0 отличает приём документов. Модель читает DOC, XLS, PPT, PDF, TXT и Markdown, понимает форматы Apple Keynote, Pages и Numbers, принимает ссылку на веб-страницу и собирает по ним видеоряд. Квартальный отчёт становится видеосводкой, обучающий модуль – мини-курсом, рекламная презентация – роликом для соцсетей.

Аппетит у Wan3.0 при этом умеренный. За один запрос принимается один файл или одна ссылка, до 100 МБ и до 50 страниц. Годовой отчёт на две сотни страниц целиком не зайдёт.

Такой вход переводит Wan3.0 из разряда «красивая пятисекундная заставка» в разряд производственного инструмента. Материал для ролика у компании обычно уже лежит в файловом хранилище и до сих пор требовал монтажёра.

Тридцать секунд и десять картинок

Предельная длина ролика у Wan3.0 – 30 секунд за одну генерацию, без склейки из кусков. Это вдвое больше, чем у прошлого поколения Wan2.7. Разрешение на выбор – 480p, 720p или 1080p. За один запрос модель принимает сразу несколько источников:

  • текстовый промпт;
  • до 10 изображений;
  • до 5 видеофрагментов;
  • до 5 аудиодорожек;
  • документ или ссылку на веб-страницу.

Платформа подсказывает оптимальную длительность под сюжет и умеет продолжать готовый ролик.

Лицо героя не плывёт между сценами

Главный акцент Alibaba делает на согласованности. Wan3.0 удерживает внешность персонажа, вид товара, планировку пространства, единый стиль и голос от сцены к сцене – то самое место, где генеративное видео обычно рассыпается. Отдельно компания заявляет о разнообразии лиц и более живой мимике, независимых замеров пока нет.

Звук Wan3.0 выдаёт синхронно с картинкой, вместе с речью, музыкой и эффектами, озвучка мультиязычная. Второй практичный момент – точечные правки. Поменять изображение, реплику или поворот сюжета можно без полной перегенерации, что для тридцатисекундного ролика экономит и время, и деньги.

Вчетверо дешевле Veo 3.1

Стоимость доступа к Wan3.0 через API считается посекундно. В базовом тарифе выходит так:

  • 480p – $0,05 за секунду, $1,50 за тридцатисекундный ролик;
  • 720p – $0,10 и $3 соответственно;
  • 1080p – $0,20 и $6.

Есть и тариф Prime с более быстрой генерацией, где те же секунды идут по $0,068, $0,14 и $0,28. С 24 августа по 23 сентября Alibaba держит на базовом тарифе скидку 30%.

Google Veo 3.1 в базовой версии просит около $0,40 за секунду, вчетверо больше, чем Wan3.0 в максимальном качестве. Ценовая агрессия объяснима. Релиз вышел следом за размещением акций почти на $10 млрд, и эти деньги идут в ИИ-инфраструктуру.

Текст в кадре пока хромает

Слабые места Alibaba называет сама. Качество надписей внутри кадра и качество звука в Wan3.0 компания признаёт требующими доработки. Для модели, которую продают как конвертер презентаций в видео, признание неудобное, потому что в презентации текст и есть основное содержание.

Пока надёжнее готовить титры и озвучку отдельно, а Wan3.0 отдавать только видеоряд.

Три двери в Wan3.0

Попробовать Wan3.0 без корпоративного контракта можно тремя путями. Первый – сайт wan.video и его генератор, вход через Google или GitHub. Доступ там пока по членству, с очередью и лимитами, но несколько роликов новичку обычно дают.

Дальше идут Alibaba Cloud Model Studio и Qwen Cloud. Новым аккаунтам дают стартовую бесплатную квоту, заметнее всего в сингапурском регионе. Взамен нужен аккаунт Alibaba Cloud с верификацией, а консоль рассчитана на разработчика.

Самый короткий путь – сторонние онлайн-генераторы видео, которые уже подключили Wan3.0. Там она идёт по кредитам, часть сервисов раздаёт стартовый пакет бесплатно. Приём документов появляется у них не сразу, так что PDF и презентации стоит проверить до оплаты.

Статья превращается в короткий ролик

Владельцам сайтов и авторам Wan3.0 интересен как дешёвый способ получить видеоверсию текста. Материал отдаётся модели ссылкой, на выходе вертикальный ролик под соцсети. Первые пробы дешевле гонять по 5–10 секунд в 480p. Десять роликов по 15 секунд в 720p – это 150 секунд генерации, около $15.

Открытые веса остались в Wan2.2

Репутацию линейке Wan сделали открытые версии. Wan2.1 и Wan2.2 выходили под лицензией Apache 2.0, их можно было скачать и запустить на своём железе, и именно это собрало вокруг модели сообщество энтузиастов. Начиная с Wan2.5 линейка закрылась, и за год смены версий наружу больше ничего не вышло.

Судить об успехе релиза стоит по тому, появится ли открытая сборка третьего поколения ближе к зиме. Если её не будет, Wan окончательно переезжает в разряд обычных облачных сервисов, где спорят ценой за секунду. По этой цене Wan3.0 пока спорит убедительно.


Ниже то, что у меня получилось сгенерировать с Wan 3.0 загрузив эту новость текстом 😂



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Google научила Antigravity SDK работать с локальными моделями без интернета

Google научила Antigravity SDK запускать ИИ-агентов на локальных моделях, в том числе без интернета. Первой поддержана открытая Gemma...

Razer выпустила одноручный кейпад Tartarus V2 Pro

Razer начала продажи Tartarus V2 Pro — одноручного игрового кейпада с 31 программируемым элементом управления. Устройство рассчитано на...

Промты для новогодней ИИ-фотосессии, +подходящие нейросети

Как говорят, готовь сани зимой, а промты для новогодних ИИ-фотосессий — в ноябре. Картинки можно публиковать уже сейчас...

Приложения для создания и обработки фото с помощью ИИ: топ-11 на Android/iPhone

Нужно создать аватар, улучшить старое фото или оживить снимок для соцсетей? Под каждую задачу есть свое приложение, где...

Google теперь позволит пользователям удалять видимый водяной знак со своих ИИ-генераций

В пятницу Google объявила, что теперь позволит пользователям удалять видимый водяной знак со своих материалов, созданных ИИ, включая...

Midjourney V8.1 ускорилась и вернула стиль

Midjourney выпустила альфа-версию V8.1, в которой разработчики сделали ставку на баланс: вернули фирменный визуальный стиль, ускорили генерацию и...

OpenAI представила обновлённый ChatGPT Images: до 4× быстрее и с новым творческим пространством

OpenAI выпустила обновлённую функцию ChatGPT Images - новый встроенный генератор изображений, который стал быстрее, точнее и удобнее для...

Kling представила Avatar 2.0 — длина видео до 5 минут, «чистый» липсинк и «живая» мимика 

Разработчики Kling AI (Kuaishou) выпустили модель Avatar 2.0 — обновление инструмента для создания говорящих цифровых аватаров. Релиз состоялся...

Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

xAI открыла общий доступ к Imagine Image 2.0 - новому режиму Quality в Grok Imagine на сайте и...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

ElevenLabs расширила свой MCP-сервер. Теперь подключённый ИИ-ассистент может создавать речь, музыку, звуковые эффекты, изображения и видео, а также...

«Ёбидоёби» запустила коллаборацию с Atomic Heart

Служба доставки «Ёбидоёби» запустила коллаборацию с Atomic Heart. В меню появился одноимённый набор из 40 роллов в лимитированной...

Консистентность персонажей и стилей в нейросетях — что это и как сохранить

Представьте: вы потратили битый час на промт и наконец получили идеального персонажа. Делаете следующий шаг — просите его...

Вышла новая ChatGPT Images 2.5 которая правит картинку по комментариям и наброску

OpenAI выпустила ChatGPT Images 2.5 - обновление генератора картинок с правками по комментариям прямо на изображении, режимом рисования...

Видео-мем «Возьми телефон, детка» (Toxi$): что это за тренд и как повторить его с помощью ИИ

Да-да, вы наверняка уже всё сами видели. Лысый парень в очках встаёт с дивана, машет руками под строчку...

Alibaba выложила Qwen-Image-2.1 – картинки с прозрачным фоном из коробки

Команда Qwen выложила в открытый доступ Qwen-Image-2.1 - модель, которая рисует изображения сразу с прозрачным фоном и правит...

OpenAI выпустила GPT-6 Sol и Luna и вдвое снизила цены

OpenAI выпустила GPT-6 Sol и GPT-6 Luna, среднюю и младшую модели поколения GPT-6. Они построены на наработках флагманской...

Сверхработоспособный Qwen 3.7 Max. Китайский ИИ, который трудится 35 часов без остановки

Среди всего того, что Alibaba представила на своем облачном саммите в мае 2026 года, флагманская языковая модель Qwen...

15 главных сериалов октября 2026 года, которые нельзя пропустить

Октябрь — самое время доставать плед, заваривать что-нибудь горячее и устраивать длинные вечера за просмотром сериалов. Тем более...