• Виктор
  • Блог
  • 1 мин. чтения

Вышла Kling Video 3.0 — ИИ-модель для генерации видео из нескольких сцен


Kuaishou выпустила Kling Video 3.0 — новую версию своей модели для генерации видео. Ключевое изменение — теперь ролик можно собирать сразу из нескольких сцен, с более стабильными персонажами и логикой между кадрами.

Пока Kling 3.0 работает в формате раннего доступа и доступна только подписчикам тарифа Ultra. Для остальных пользователей модель обещают открыть позже.

Kling Video 3.0 — что это и как работает

Раньше Kling, как и большинство видеомоделей, генерировала один короткий клип по одному промпту. Каждый запуск давал новый результат: персонажи менялись, сцены «прыгали», движения были случайными.

В версии 3.0 появилась multi-shot-генерация. Модель может собрать один ролик сразу из нескольких сцен — например, общий план, затем средний и крупный. Всё формируется в одном видео, без склейки отдельных клипов.

Параллельно усилили работу с референсами. Через систему Elements можно загрузить несколько изображений, чтобы зафиксировать персонажа, стиль или окружение.

Video 3.0 Omni

Video 3.0 Omni — это обновление мультимодальной модели O1 до архитектуры 3.0 с расширенным контролем сцены. В этом режиме можно вручную задавать длительность кадров, перспективу и движение камеры.

Через Elements поддерживается загрузка аудио с речью от 3 секунд для извлечения голоса, а также видео с персонажем длительностью от 3 до 8 секунд. Модель сохраняет внешность и голос и использует их в последующих сценах.

Как пользоваться

В интерфейсе сервиса выберите Kling Video 3.0. Для стабильного результата загрузите референсы через Elements. Multi-shot используйте, если нужен ролик из нескольких сцен.

Генерация речи и липсинк поддерживаются на китайском, английском, японском, корейском и испанском языках, включая акценты и диалекты. Русский язык тоже работает, но возможны ошибки.

Почему это важно? Апдейт прокачивает модель не в сторону «красивой картинки», а в сторону архитектуры генерации. Видео теперь формируется как последовательность сцен, а не как один случайный фрагмент. За счёт этого Kling 3.0 обещает выдавать связное видео до 15 секунд за один проход.

Предыдущее обновление — версия 2.6 — было сосредоточено на качестве изображения и базовом управлении камерой. Релиз 3.0 — это фактически перезапуск всей видеолинейки с упором на готовый результат, консистентность и управляемость, а не просто на визуальный эффект.

Итог: Kling 3.0 смещает фокус с генерации случайных красивых кадров на создание последовательных видео с сохранением лиц, голосов и логики монтажа.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

OpenAI представила обновлённый ChatGPT Images: до 4× быстрее и с новым творческим пространством

OpenAI выпустила обновлённую функцию ChatGPT Images - новый встроенный генератор изображений, который стал быстрее, точнее и удобнее для...

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

Suno вводит лимиты на скачивание — до 7 треков бесплатно

Suno объявила, что с 3 сентября введёт лимиты на скачивание созданной музыки. На бесплатном тарифе пользователи, зарегистрировавшиеся до...

Глава Microsoft AI назвал новые отчёты OpenAI серьёзной ситуацией

Мустафа Сулейман, глава Microsoft AI, назвал в эфире CNBC 18 сентября раскрытые OpenAI случаи странного поведения моделей «довольно...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...

DeepSeek представила DeepSeek-OCR — новую модель для сжатия визуального контекста в LLM

Компания DeepSeek показала DeepSeek-OCR — OCR-модель, созданную специально для больших языковых моделей. Вместо обычного распознавания текста она сжимает...

Claude Fable 5. Модель ИИ, которой можно сказать «разберись» и уйти пить кофе

Есть такой тип людей, которым нельзя давать простые задачи. Они все равно решат их как-то по-своему, с избыточным...

OpenAI выпустила GPT-6 Sol и GPT-6 Luna — новые модели уже доступны в ChatGPT и Codex

OpenAI начала развёртывание GPT-6 Sol и GPT-6 Luna. Новые модели уже появляются в ChatGPT Work и Codex, а...

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений

Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом,...

OpenAI уберёт GPT-5.5 из ChatGPT и Codex 14 октября

OpenAI предупредила о завершении поддержки GPT-5.5 в ChatGPT, ChatGPT Work и Codex. Модель уберут из этих продуктов 14...

ByteDance выпустила Seedream 5.0 Pro для инфографики и точного редактирования изображений

ByteDance Seed 8 июля 2026 года представила Seedream 5.0 Pro - мультимодальную модель для генерации и редактирования изображений....

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

30 июня Google открыла доступ к двум новым моделям генеративной графики и видео - Nano Banana 2 Lite...

Kling 4.0 выйдет в октябре, а Flash уже доступна подписчикам Ultra

Kling AI анонсировала видеомодель Kling 4.0 с выходом в октябре, а облегчённая Kling 4.0 Flash уже работает у...

Консистентность персонажей и стилей в нейросетях — что это и как сохранить

Представьте: вы потратили битый час на промт и наконец получили идеального персонажа. Делаете следующий шаг — просите его...

Kling добавила нативную генерацию в 4K в версии Video 3.0

Kling запустила режим 4K Mode в линейке Video 3.0. Теперь видео можно генерировать сразу в 4K — без...

ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу

ElevenLabs представила Music v2.5 — новую версию модели для генерации музыки. Она создаёт более многослойные композиции, точнее следует...

OpenAI интегрировала ChatGPT в Microsoft Word через общую офисную надстройку

OpenAI выпустила интеграцию ChatGPT для текстового редактора Microsoft Word. Инструмент встраивается в боковую панель программы и доступен на...

Маркетолог PRO от MTC ADS: отзывы и возможности сервиса для запуска бизнес-рекламы в Telegram

Результативность рекламной кампании зависит от десятков, даже сотен факторов. Один из основных критериев — определение целевой аудитории и...

Google теперь позволит пользователям удалять видимый водяной знак со своих ИИ-генераций

В пятницу Google объявила, что теперь позволит пользователям удалять видимый водяной знак со своих материалов, созданных ИИ, включая...