• Виктор
  • Блог
  • 2 мин. чтения

Veo 3.1 уже доступна на WaveSpeedAI — создаёт видео из текста и картинок


Платформа WaveSpeedAI представила интеграцию с новой моделью Google Veo 3.1 — одной из самых продвинутых ИИ-моделей для генерации видео (мы уже писали про скорый релиз). Теперь пользователи могут создавать ролики из текста или изображения в нативном 1080p и с контекстно-синхронизированным звуком. Мы уже сделали гайд: «Как создавить видео в Veo 3.1».

Модель получила обновлённый базовый движок, который делает движения более «живыми» и добавляет кинематографичные переходы. Алгоритм R2V (Render-to-Video) улучшает консистентность персонажей и объектов — теперь герой не «меняет лицо» или одежду между кадрами. Подробности в материале Postium.

Что умеет нейросеть Veo 3.1 от Google и как ей пользоваться

WaveSpeedAI — один из первых публичных сервисов, где Veo 3.1 доступна без ограничений API, в веб-интерфейсе и без необходимости установки моделей локально.

Возможности Veo 3.1:

  • Нативное 1080p и 24 кадра/с. Видео готово к публикации без апскейла.
  • Контекст-aware аудио. Модель автоматически подбирает саундтрек и эффекты под действие на экране.
  • Поддержка портретного и альбомного форматов. Удобно для TikTok, Reels и YouTube Shorts.
  • Функция «Image-to-Video». Достаточно одной картинки — Veo анимирует сцену, добавив движение камеры и объём.
  • Режим Fast. Генерация на 20–30% быстрее при чуть меньших вычислительных затратах.
  • Повторяемость. Можно зафиксировать seed, чтобы получить одинаковый результат при разных рендерах.

Промт для Veo 3.1:

Two person street interview in New York City.
Sample Dialogue:
Host: "Did you hear the news?"
Person: "Yes! Veo 3.1 is now available on WaveSpeedAI. If you want to see it, go check their website."

Результат:

Ещё один пример промта для Veo 3.1:

Context: A Panda named Bamboo and a Red Fox named Tweed host a casual, witty podcast called "Quantum Quibbles."
Task: Write the absolute shortest, most punchy opening exchange for an episode on quantum entanglement. Focus only on quick introductions and the topic title.
Panda (Bamboo): "Welcome to Quantum Quibbles! I'm Bamboo."
Red Fox (Tweed): "And I'm Tweed!"
Panda (Bamboo): "Today: Quantum Entanglement!"
Red Fox (Tweed): "Let's dive in."

Результат:

Кроме того, система стала лучше понимать глубину сцены и работу камеры: поддерживаются эффекты pan, tilt, zoom и dolly, что позволяет имитировать реальные движения объектива.

На сайте WaveSpeedAI доступны четыре режима работы:

  • Text-to-Video: создание видео по описанию;
  • Image-to-Video: анимация изображения;
  • Fast Text-to-Video / Image-to-Video: ускоренные версии для черновых итераций.

Стоимость запуска видео на платформе — от $3,2 за стандартную генерацию. Интерфейс позволяет выбирать длину ролика, ориентацию кадра и интенсивность деталей. Кроме того, появилась возможность испытать Veo 3.1 и на платформах типа Flux AI.

Модель Veo — флагманская разработка Google DeepMind в сфере ИИ-видео. Первая версия была представлена весной 2024 года, но ограничивалась короткими клипами и беззвучным выводом. В версии 3.0 Google добавил 1080p и вертикальные форматы, а 3.1 стала первым релизом с синхронным звуком и улучшенной пластикой движения.

По данным отраслевых аналитиков, Veo 3.1 способна генерировать клипы длиной до 60 секунд с сохранением логики движения и световых эффектов, что делает её одним из конкурентов Sora 2.

Ранее Google обновил главную страницу AI Studio.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Выход CapCut Video Studio и интеграция Dreamina Seedance 2.0 в CapCut

CapCut представила Video Studio - новый ИИ-режим создания роликов внутри веб-версии сервиса. Продукт важен не только как очередная...

YouTube позволит генерировать Shorts с помощью Veo 3

На мероприятии «Made on YouTube» 16 сентября компания представила большое обновление для Shorts и YouTube Studio. В сервис...

Google довела ролики Gemini Omni до сорока секунд и сделала черновики втрое дешевле

Gemini Omni 1.1 Flash научилась достраивать снятую сцену продолжениями и доводить ролик до сорока секунд, а перед чистовой...

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений

Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом,...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Как пользоваться QwenWork: регистрация, возможности, бесплатные кредиты и тарифы

QwenWork — это новый ИИ-агент от Alibaba, который доступен на сайте и через отдельное приложение. По принципу работы...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...

Razer выпустила одноручный кейпад Tartarus V2 Pro

Razer начала продажи Tartarus V2 Pro — одноручного игрового кейпада с 31 программируемым элементом управления. Устройство рассчитано на...

Pika Labs запустила Pika Agents

Pika Labs вывела Pika Agents в открытый доступ и предложила другой способ работы с генеративным ИИ. Вместо привычного...

Обновлённый Reve: свобода творчества без технических барьеров

Reve представила обновлённую платформу для генерации и редактирования изображений, стремясь сделать визуальное творчество доступным без технических барьеров. Новый...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...

Veo 3.1 уже доступна на WaveSpeedAI — создаёт видео из текста и картинок

Платформа WaveSpeedAI представила интеграцию с новой моделью Google Veo 3.1 — одной из самых продвинутых ИИ-моделей для генерации...

Perplexity Computer научилась создавать видео для кампаний и соцсетей

Perplexity добавила генерацию видео в ИИ-агента Computer. Сервис использует модели MiniMax H3 и ByteDance Seedance 2.5 и может...

Claude Code ушёл в облако: Anthropic открыла облачные сессии для всех и раздаёт до $250 на тест

24 сентября 2026 года Anthropic перевела облачные сессии Claude Code в общий доступ. Раньше функция работала в статусе...

От Google Translate к Gemini. Новая модель приближает синхронный перевод к живому диалогу

Двадцать лет назад Google Translate был всего лишь одним из первых машинных экспериментов с языком. Сначала он переводил...

OpenAI интегрировала ChatGPT в Microsoft Word через общую офисную надстройку

OpenAI выпустила интеграцию ChatGPT для текстового редактора Microsoft Word. Инструмент встраивается в боковую панель программы и доступен на...

Alibaba открыла QwenWork по всему миру — ИИ-агент работает в браузере и на компьютере

Alibaba открыла международную версию QwenWork в формате публичной беты. Это рабочая платформа с ИИ-агентом: пользователь описывает задачу обычным...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

Kling 4.0 выйдет в октябре, а Flash уже доступна подписчикам Ultra

Kling AI анонсировала видеомодель Kling 4.0 с выходом в октябре, а облегчённая Kling 4.0 Flash уже работает у...