• Виктор
  • Блог
  • 2 мин. чтения

Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео


Kling AI выпустила новую ИИ-модель Kling O1 (Omni One). Это рассуждающая нейросеть, которая генерирует видео по тексту и редактирует уже снятые ролики с помощью простых промтов: можно менять объекты, добавлять элементы, удалять лишнее и полностью менять стиль сцены без пересъёмки и ручных масок.

Модель уже доступна на сайте Kling, а также на платформах, включая Fal AI, VEED, Wavespeed и прочие. Подробности в материале Postium.

Нейросеть Kling O1 — что это и как работает

Kling O1 — мультимодальная модель, которая понимает текст, изображения и видео одновременно. Она использует Chain of Thought: сначала разбирает промт на смысловые элементы — что в кадре, как двигается камера, какой свет — и лишь потом создаёт или перерабатывает ролик. Это повышает точность движения, стабильность объектов и соответствие запросу.

В основе лежит Multi-Modal Video Engine — движок, который анализирует исходное видео или кадры, сопоставляет их с описанием и (если нужно) с референсом, а затем встраивает изменения так, чтобы ролик оставался целостным от начала до конца.

У модели три рабочих режима:

  • Multi-Elements (video-to-video) — точечное редактирование уже снятого ролика по тексту;
  • text-to-video — полноценная генерация по описанию;
  • frame mode — построение видео между заданными начальным и финальным кадрами.

Главное отличие от Kling 1.6 — более точное следование промту для генерации видео и стабильность объектов. Персонажи реже «ломаются» между кадрами, камеры двигаются предсказуемее, а движения выглядят естественнее.

Что реально изменилось? Теперь можно текстом менять элементы внутри настоящего видео — заменять предметы, добавлять эффекты, убирать лишние детали или перестилизовывать ролик. Раньше такие задачи требовали пересъёмки или полноценного VFX-цикла.

Кроме того, в генерации O1 лучше удерживает детали и реже уходит в «творческую самодеятельность». Frame mode даёт почти операторский контроль — можно задать кадры «начала» и «конца» и получить видео, которое между ними развивается плавно и в нужной манере.

Как пользоваться Kling O1?

Зайдите на сайт Kling (или любую платформу, где доступна нейросеть) и выберите модель Kling O1. В text-to-video пишется подробный промпт с описанием объектов, действий, света и поведения камеры.

В Multi-Elements загружается исходное видео (до 10 секунд) и до 4 картинок, либо до 7 картинок в качестве референса. Дальше в промте указывается, что заменить, что удалить или как изменить стиль.

В frame mode загружаются два изображения, а текстом описывается динамика между ними. Модель сама строит движение и сцену.

Предыдущие модели Kling делали ставку на генерацию коротких роликов по тексту и изображениям, но слабо справлялись с редактированием настоящего видео. Мультимодальность O1 и новый движок расширили эти возможности.

Итог: Kling O1 превращает генератор видео в инструмент постпродакшена: теперь можно править уже снятые ролики по текстовому описанию и обрабатывать материал.

Ранее вышла ИИ-модель для генерации видео HunyuanVideo 1.5.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Luma Labs представила модель Uni-1 которая думает и рисует одновременно

Luma Labs представила Uni-1 - первую генеративную модель, которая объединяет мышление и создание изображений в одном процессе. Система...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...

Промты для новогодней ИИ-фотосессии, +подходящие нейросети

Как говорят, готовь сани зимой, а промты для новогодних ИИ-фотосессий — в ноябре. Картинки можно публиковать уже сейчас...

Suno выпустила бесплатную модель «v4.5-all» — нейросеть создаёт топовую музыку и вокал

Нейросеть Suno AI официально заменила старую модель «v3.5» на более новую «v4.5-all» в бесплатной версии сервиса. Теперь пользователи...

Synthesia встроила агента в редактор и обновила модель аватаров

Synthesia запустила Assistant - чат-агента, который собирает ролик из промпта, документа или ссылки прямо в редакторе и правит...

OpenAI выпустила GPT-6 Sol и GPT-6 Luna — новые модели уже доступны в ChatGPT и Codex

OpenAI начала развёртывание GPT-6 Sol и GPT-6 Luna. Новые модели уже появляются в ChatGPT Work и Codex, а...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

Промты для коллажей — как сделать коллаж по фото с помощью ИИ

Хотите красивые фоточки для соцсетей, но без одинаковых селфи? Держите 5 промтов для трендовых коллажей: неон ночью, дождь...

DeepSeek представила DeepSeek-OCR — новую модель для сжатия визуального контекста в LLM

Компания DeepSeek показала DeepSeek-OCR — OCR-модель, созданную специально для больших языковых моделей. Вместо обычного распознавания текста она сжимает...

Гайд по размерам для YouTube: шапка канала, обложка видео, Shorts, аватар, лого

Если вы загружаете ролики на YouTube и оформляете канал, размеры лучше определить заранее. Иначе шапка обрежется на смартфоне,...

OpenAI выпустила GPT-6 Sol и Luna и вдвое снизила цены

OpenAI выпустила GPT-6 Sol и GPT-6 Luna, среднюю и младшую модели поколения GPT-6. Они построены на наработках флагманской...

Anthropic объединила чат с Cowork и встроила редакторы документов и слайдов прямо в Claude

Anthropic объединила стандартный диалоговый чат и рабочий режим Cowork в единый интерфейс Claude. Модель теперь сама определяет характер...

Вышла Kling Video 3.0 — ИИ-модель для генерации видео из нескольких сцен

Kuaishou выпустила Kling Video 3.0 — новую версию своей модели для генерации видео. Ключевое изменение — теперь ролик...

Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию,...

Veo 3.1 уже доступна на WaveSpeedAI — создаёт видео из текста и картинок

Платформа WaveSpeedAI представила интеграцию с новой моделью Google Veo 3.1 — одной из самых продвинутых ИИ-моделей для генерации...

Маркетолог PRO от MTC ADS: отзывы и возможности сервиса для запуска бизнес-рекламы в Telegram

Результативность рекламной кампании зависит от десятков, даже сотен факторов. Один из основных критериев — определение целевой аудитории и...

Конспект видео нейросетью: чек-лист для новичка

Часовая запись вебинара, лекция на полтора часа, интервью на YouTube, которое нужно пересказать коллеге за пять минут —...

ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

ElevenLabs расширила свой MCP-сервер. Теперь подключённый ИИ-ассистент может создавать речь, музыку, звуковые эффекты, изображения и видео, а также...

Alibaba сообщила о падении прибыли на 75% из-за крупных инвестиций в ИИ-инфраструктуру

Китайский технологический гигант Alibaba в четверг сообщил о падении прибыли за последний квартал на 75% на фоне крупных...

Лимиты использования в ChatGPT/Codex: где посмотреть и как сбросить

Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы...