• Виктор
  • Блог
  • 2 мин. чтения

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон


Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается в готовый ролик с диалогами, живыми звуками и эффектами, без монтажа и сторонних сервисов.

Модель уже доступна пользователям на сайте Kling, на партнёрских платформах и плейграундах. Подробнее в материале Postium.

Нейросеть Kling VIDEO 2.6 — что умеет и как работает

VIDEO 2.6 генерирует визуал и звук внутри одной модели. Она одновременно считает, что происходит в кадре, кто говорит, какие эмоции и какие звуки должны сопровождать сцену. На выходе — уже собранный клип, где совпадают движение губ, ритм и звук.


Что нового:

  • Видео и звук теперь генерятся вместе и синхронно.
  • Голоса звучат естественно, а движение губ совпадает с речью.
  • В промте можно задавать эмоции, тембр, шумы и отдельные SFX.
  • Диалоги, монологи и музыкальные вставки создаются за один прогон.

Ключевая фишка в том, что звук не приклеивается сверху. Он создаётся вместе с видео и синхронизируется автоматически.

Как пользоваться Kling VIDEO 2.6?

Функция доступна в интерфейсах Kling, на различных агрегаторах (Higgsfield) и плейграундах (Fal Ai, Wavespeed).

На сайте Kling VIDEO 2.6 работает в двух режимах: text-to-video и image-to-video.

В text-to-video вы вводите подробный промт для генерации видео. В нём описываете сцену, персонажей, их реплики, эмоции, звук окружения, музыку и любые эффекты. Затем обязательно включаете опцию «Native audio» — именно она активирует встроенную озвучку. После генерации появляется ролик, где визуал и звук уже собраны в один файл.

В image-to-video логика та же, только вы добавляете один стартовый кадр или несколько фреймов, которые служат основой сцены. Далее прописываете промпт со звуками, диалогами и атмосферой. Опцию «Native audio» также нужно включить обязательно. Модель на основе кадров и текста выдаёт короткий озвученный эпизод.

Цена. На самом Kling подписка Standard, в которую входит VIDEO 2.6, начинается от 7 долларов в месяц. Бесплатного режима нет, потестировать без оплаты не получится.

На WaveSpeed один прогон text-to-video стоит $1,4 — для сравнения, у Veo 3.1 такой же запрос обходится примерно в $3,2.

Почему это важно? Это третий релиз Kling за три дня. Сначала вышла Kling O1, рассуждающая модель для создания и правки видео. Затем — IMAGE O1 новая модель для генерации и редактирования изображений.  VIDEO 2.6 продолжают серию обновлений и мы ждём ещё как минимум два релиза.

Итог: один текстовый запрос теперь превращается в короткий ролик со звуком — без ручной озвучки и монтажа.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Нейросеть для сложных расчётов: чек-лист для новичка

Недавно нейросеть Claude посчитала физическую задачу, с которой годами возились специалисты — расчёт на девять петель в квантовой...

Вышла нейросеть Suno 5.5 — ИИ генерирует треки с вашим голосом

Suno AI выпустила модель v5.5 и вместе с ней набор функций, которые меняют логику сервиса. Теперь это не...

Alibaba выпустила Qwen-Image 2.1 с генерацией прозрачных изображений

Команда Qwen выпустила Qwen-Image 2.1 — модель для генерации и редактирования изображений. Веса опубликованы 20 сентября 2026 года...

DeepSeek выпустила V4.1 Flash — открытую ИИ-модель с контекстом до 1 млн токенов

DeepSeek выпустила DeepSeek V4.1 Flash и открыла веса модели на Hugging Face. Она принимает текст и изображения, отвечает...

«Ёбидоёби» запустила коллаборацию с Atomic Heart

Служба доставки «Ёбидоёби» запустила коллаборацию с Atomic Heart. В меню появился одноимённый набор из 40 роллов в лимитированной...

Google запускает Nano Banana – новая эра редактирования изображений

Google представила модель искусственного интеллекта Nano Banana - предварительную версию Gemini 2.5 Flash Image, которая уже доступна пользователям...

DeepSeek выпустила Harness v0.2 — приложение для macOS и Windows

У ИИ-агента DeepSeek Harness появилась настольная версия. Теперь его можно установить как обычную программу и поручать ему работу...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

ElevenLabs запустила Flows Agent в ElevenCreative — агент строит workflow по текстовому запросу

ElevenLabs представила Flows Agent в ElevenCreative. Пользователь описывает, что хочет создать, а ИИ-агент подбирает модели, добавляет узлы на...

ComfyUI заморозила новые бесплатные аккаунты в Comfy Cloud из-за злоупотреблений видеомоделями

ComfyUI временно остановила создание новых бесплатных аккаунтов в Comfy Cloud. Причина - инцидент со злоупотреблениями, в котором атаковали...

Suno вводит лимиты на скачивание — до 7 треков бесплатно

Suno объявила, что с 3 сентября введёт лимиты на скачивание созданной музыки. На бесплатном тарифе пользователи, зарегистрировавшиеся до...

Kling 4.0 выйдет в октябре, а Flash уже доступна подписчикам Ultra

Kling AI анонсировала видеомодель Kling 4.0 с выходом в октябре, а облегчённая Kling 4.0 Flash уже работает у...

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

«Звук» запустил «Атлас» — интерактивную карту музыкального вкуса

Музыкальный сервис «Звук» запустил «Атлас» — персональную карту, которая показывает любимые жанры и настроения пользователя. На ней можно...

Видео-мем «Возьми телефон, детка» (Toxi$): что это за тренд и как повторить его с помощью ИИ

Да-да, вы наверняка уже всё сами видели. Лысый парень в очках встаёт с дивана, машет руками под строчку...

Сбой в xAI заставил чат-бот Grok выдавать пользователям бессвязный текст

Необычный сбой привёл к тому, что чат-бот Grok компании xAI начал выдавать многим пользователям бессвязный текст. После просьбы...

OpenAI сняла лимиты на текстовые чаты в ChatGPT для всех пользователей

OpenAI объявила об отмене лимитов на текстовые чаты для всех пользователей ChatGPT. Сервис, по данным компании, недавно преодолел...

ElevenLabs выпустили Eleven v4 и v4 Turbo — ИИ для озвучки с управлением эмоциями и манерой речи

ElevenLabs представила новые модели синтеза речи Eleven v4 и Eleven v4 Turbo. Они построены на новой архитектуре и...