• Виктор
  • Блог
  • 2 мин. чтения

Kling представила Avatar 2.0 — длина видео до 5 минут, «чистый» липсинк и «живая» мимика 


Разработчики Kling AI (Kuaishou) выпустили модель Avatar 2.0 — обновление инструмента для создания говорящих цифровых аватаров. Релиз состоялся в рамках продуктовой недели Omni Launch Week.

Модель уже доступна в веб-версии Kling AI. Бесплатно доступно ограниченное количество кредитов, безлимит и более высокое качество — в платных тарифах. Postium собрал больше деталей.

Что нового в Kling Avatar 2.0?

В обновлении усилили портретную точность: модель куда лучше держит лицо, мимику и пропорции, почти без «плывущих» черт и случайных искажений. Липсинк сделали заметно чище — губы теперь совпадают с аудио без рывков и задержек, а к анимации добавили микродвижения глаз и головы, из-за чего аватар выглядит более живым.


Главный прорыв — длительность. Теперь можно генерировать ролики до пяти минут, и модель стабильно удерживает лицо и эмоции на всём протяжении. В предыдущих версиях длинные сцены разваливались, поэтому формат «говорящая голова» наконец стал рабочим инструментом, а не коротким трюком.

На входе стало гибче: достаточно одного фото и аудио, а через промт можно управлять эмоциями, интонацией и стилем анимации. Модель уверенно восстанавливает лицо даже с неудачных референсов. Качество выросло до 1080p при 30–48 FPS — движения плавнее, меньше артефактов на коже и волосах.

Появились две версии модели: Standard для экономии и Pro для максимальной стабильности и детализации. Разница не «драматическая», но Pro полезна, когда нужна стопроцентная консистентность лица. Добавили и интеграцию с ElevenLabs, чтобы подключать собственные голоса.

Тестировать можно бесплатно: дают 66 кредитов в день (до 166 в месяц), чего хватает на пробы. Минимальный платный тариф — $6.99 в месяц за 660 кредитов и ролики до 30 секунд без водяного знака. Премиальное видео расходует примерно 100 кредитов за 5 секунд, так что 90 секунд обходятся около $30.

Как пользоваться Kling Avatar 2.0?

Механика осталась прежней:

  1. Загружаете портретное фото (анфас) или выбираете готового персонажа.
  2. Вводите текст или загружаете аудиофайл (до 5 минут).
  3. Настраиваете параметры, вводите промт и запускаете генерацию.

Выход Avatar 2.0 — часть масштабного обновления линейки Kling в декабре 2025 года. Ранее на этой неделе компания уже представила единую мультимодальную модель Video O1 и модель для работы с изображениями Image O1.

Итог: Kling Avatar 2.0 превратился в полноценное решение для создания длинного видеоконтента с реалистичной мимикой.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

NotebookLM научился делать минутные вертикальные видео из документов

Google добавила в NotebookLM новый формат - Short Video Overviews. Сервис автоматически собирает из загруженных документов короткое вертикальное...

«Звук» запустил «Атлас» — интерактивную карту музыкального вкуса

Музыкальный сервис «Звук» запустил «Атлас» — персональную карту, которая показывает любимые жанры и настроения пользователя. На ней можно...

Suno Studio 2.0 приближается к полноценной DAW благодаря поддержке MIDI и чат-боту с ИИ

Suno представила Studio 2.0 со значительными обновлениями, которые приближают ее к полноценной цифровой звуковой рабочей станции (DAW), а не к...

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

30 июня Google открыла доступ к двум новым моделям генеративной графики и видео - Nano Banana 2 Lite...

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Alibaba выложила Qwen-Image-2.1 – картинки с прозрачным фоном из коробки

Команда Qwen выложила в открытый доступ Qwen-Image-2.1 - модель, которая рисует изображения сразу с прозрачным фоном и правит...

Anthropic выпустила Claude Opus 5.5 — модель стала быстрее и дешевле 

Anthropic выпустила Claude Opus 5.5 для Claude, Claude Code и Claude Platform. Новая модель генерирует ответы более чем...

Grok научился расшифровывать речь вдвое точнее и за те же деньги

SpaceXAI выпустила Grok Voice Transcribe 2.0, модель для перевода речи в текст. По внутренним тестам компании она вдвое...

Miu Miu и New Balance выпустили балетную версию кроссовок 530 SL

Miu Miu и New Balance выпустили балетки на основе 530 SL. От кроссовок модели достались шнуровка, резиновая подошва...

Qwen выпустила плагины Qwen-MM для мультимодальных ИИ-агентов

Команда Qwen опубликовала Qwen-MM-Plugins — набор открытых плагинов для работы ИИ-агентов с изображениями, видео и документами. Репозиторий поддерживает...

OpenAI сняла лимиты на текстовые чаты в ChatGPT для всех пользователей

OpenAI объявила об отмене лимитов на текстовые чаты для всех пользователей ChatGPT. Сервис, по данным компании, недавно преодолел...

Claude Fable 5. Модель ИИ, которой можно сказать «разберись» и уйти пить кофе

Есть такой тип людей, которым нельзя давать простые задачи. Они все равно решат их как-то по-своему, с избыточным...

ByteDance выпустила Seedream 5.0 Pro для инфографики и точного редактирования изображений

ByteDance Seed 8 июля 2026 года представила Seedream 5.0 Pro - мультимодальную модель для генерации и редактирования изображений....

OpenAI выпустила GPT-6 Sol и GPT-6 Luna — новые модели уже доступны в ChatGPT и Codex

OpenAI начала развёртывание GPT-6 Sol и GPT-6 Luna. Новые модели уже появляются в ChatGPT Work и Codex, а...

Нейросеть Кандинский 3.0: как пользоваться, как обрабатывать фото и создавать картинки

Кандинский – это бесплатная нейросеть от Сбера, способная генерировать картинки по текстовому описанию. Работает по сходному с Midjourney...

Pika превратила генератор видео в платформу с набором приложений и мультимодельным стеком

Компания Pika запустила обновленную креативную платформу на pika.art. Сервис перестроили вокруг специализированных мини-приложений для видеомонтажа, ретуши и работы...

Comfy MCP: ComfyUI подключает ИИ-агентов к своим пайплайнам генерации

Команда ComfyUI открыла публичную бету Comfy MCP - коннектор, через который ИИ-агенты вроде Claude, Codex, Cursor и Hermes...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

Alibaba сообщила о падении прибыли на 75% из-за крупных инвестиций в ИИ-инфраструктуру

Китайский технологический гигант Alibaba в четверг сообщил о падении прибыли за последний квартал на 75% на фоне крупных...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...