• Виктор
  • Блог
  • 2 мин. чтения

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений


Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом, и с референсами, обещает высокую консистентность, точные правки и гибкую стилизацию.

Модель уже выпущена и доступна пользователям на сайте Kling, а также через сторонние платформы fal.ai, WaveSpeedAI и другие. Подробнее на сайте Postium.

Kling IMAGE O1 — что умеет и как работает

IMAGE O1 — мульти-модель для создания и редактирования визуального контента. Она принимает текст, готовые изображения и до десяти референсов, чтобы сохранять форму объектов, их стиль и композицию.

Модель генерирует изображения с нуля, а также вносит правки в уже готовые — меняет материалы, стиль, фон и освещение без ручных масок.

Главный акцент — консистентность: персонажи, сцены и стилистика остаются едиными от кадра к кадру. Также появилась возможность удерживать стиль по нескольким референсам — важно для брендов, игровых студий и художников, которые работают с сериями изображений.

Кроме того, инструмент впервые получил функции редактирования. Вносить правки можно через текстовые запросы: менять объекты, материалы, фон, освещение и стиль. Пользователь описывает, что нужно изменить, — модель сама вносит правки.

Как пользоваться Kling IMAGE O1

Зайдите на сайт Kling, откройте раздел омни-моделей и внизу выберите режим генерации изображений. Затем настройте нужные параметры. Перед запуском загрузите референсы или просто введите промт.

Другой вариант — на любой платформе, где доступна новая ИИ-модель, переходим в режим генерации изображений и выбираем Kling IMAGE O1.

Дальше можно сгенерировать изображение по тексту или загрузить один или несколько референсов. Например, загрузить картинки с человеком и машиной, и попросить сгенерировать, как человек сидит в этой машине.

Для редактирования достаточно загрузить картинку и описать изменения: модель сама встраивает правки в сцену.

Таким образом, Kling продолжает расширять линейку O1, превращая её в самостоятельное направление. В серии уже появляются как модель Kling O1 для видео, так и инструменты для генерации и редактирования изображений.

Итог: Kling выпустила новый мультимодальный генератор изображений, объединив возможности своих предыдущих моделей и добавив обновлённые инструменты для редактирования.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

Pika Labs запустила Pika Agents

Pika Labs вывела Pika Agents в открытый доступ и предложила другой способ работы с генеративным ИИ. Вместо привычного...

«Звук» запустил «Атлас» — интерактивную карту музыкального вкуса

Музыкальный сервис «Звук» запустил «Атлас» — персональную карту, которая показывает любимые жанры и настроения пользователя. На ней можно...

Обзор платформы lava.top

lava.top — это международная платформа для продажи контента, позволяющая создавать и продавать цифровые продукты без подключения дополнительных платежных...

Krea открыла API для Krea 2 с переносом стиля и мудбордами

Krea открыла API для Krea 2 - своей первой базовой модели генерации изображений, обученной с нуля. Анонс опубликован...

Google теперь позволит пользователям удалять видимый водяной знак со своих ИИ-генераций

В пятницу Google объявила, что теперь позволит пользователям удалять видимый водяной знак со своих материалов, созданных ИИ, включая...

Alibaba выложила Qwen-Image-2.1 – картинки с прозрачным фоном из коробки

Команда Qwen выложила в открытый доступ Qwen-Image-2.1 - модель, которая рисует изображения сразу с прозрачным фоном и правит...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...

OpenAI выпустила GPT Image 2 и ChatGPT Images 2.0

OpenAI представила GPT Image 2 для API и одновременно обновила генерацию изображений в ChatGPT до версии Images 2.0....

Synthesia встроила агента в редактор и обновила модель аватаров

Synthesia запустила Assistant - чат-агента, который собирает ролик из промпта, документа или ссылки прямо в редакторе и правит...

Alibaba сообщила о падении прибыли на 75% из-за крупных инвестиций в ИИ-инфраструктуру

Китайский технологический гигант Alibaba в четверг сообщил о падении прибыли за последний квартал на 75% на фоне крупных...

Gemini 3.8 Live получила видеоаватар для бизнеса

Google выпустила Gemini 3.8 Live with Live Avatar, режим с почти синхронным видеоаватаром для разговорных моделей. Функция доступна...

OpenAI выпустила GPT-6 Sol и GPT-6 Luna — новые модели уже доступны в ChatGPT и Codex

OpenAI начала развёртывание GPT-6 Sol и GPT-6 Luna. Новые модели уже появляются в ChatGPT Work и Codex, а...

GLM 5.3: мощнее в коде и кибербезопасности

14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской...

YouTube позволит генерировать Shorts с помощью Veo 3

На мероприятии «Made on YouTube» 16 сентября компания представила большое обновление для Shorts и YouTube Studio. В сервис...

ComfyUI заморозила новые бесплатные аккаунты в Comfy Cloud из-за злоупотреблений видеомоделями

ComfyUI временно остановила создание новых бесплатных аккаунтов в Comfy Cloud. Причина - инцидент со злоупотреблениями, в котором атаковали...

От Google Translate к Gemini. Новая модель приближает синхронный перевод к живому диалогу

Двадцать лет назад Google Translate был всего лишь одним из первых машинных экспериментов с языком. Сначала он переводил...

ByteDance выпустила Seedream 5.0 Pro для инфографики и точного редактирования изображений

ByteDance Seed 8 июля 2026 года представила Seedream 5.0 Pro - мультимодальную модель для генерации и редактирования изображений....

ElevenLabs представила Studio 4.0 с генерацией видео, изображений и звука

ElevenLabs выпустила Studio 4.0 — обновлённый редактор, а также Studio Agent. В одном проекте теперь можно генерировать видео,...

Выход CapCut Video Studio и интеграция Dreamina Seedance 2.0 в CapCut

CapCut представила Video Studio - новый ИИ-режим создания роликов внутри веб-версии сервиса. Продукт важен не только как очередная...