• Виктор
  • Блог
  • 2 мин. чтения

Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям


xAI открыла общий доступ к Imagine Image 2.0 – новому режиму Quality в Grok Imagine на сайте и в мобильных приложениях. Модель правит выбранный участок картинки, снимает фон, достраивает кадр под другой формат и принимает до пяти референсов сразу.

Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

Grok Imagine – визуальная часть Grok, чат-бота компании xAI, где генерируют изображения и видео. Image 2.0 – новое поколение картиночной модели, и подаёт его компания как инструмент под рабочие задачи: товарные фото, постеры, портреты, иконки, ассеты для игр. Доступ открыт сразу всем, режима ожидания и списков нет.

Волшебная палочка правит один участок

Главное изменение в Image 2.0 касается правок. Волшебная палочка меняет ту область кадра, на которую вы указали, остальное остаётся нетронутым – раньше повторная генерация переписывала картинку целиком и заодно портила то, что уже устраивало. Сегментация выделяет точные контуры объекта под замену. Удаление фона отдаёт объект на прозрачном слое, готовым к вставке в чужой макет.

Логика понятная: первая генерация редко становится финальным файлом, и Grok Imagine наконец признаёт это устройством интерфейса.

До пяти референсов за раз

Multi-ref принимает до пяти входных изображений в одной генерации – персонаж, товар, фон и стилистический ориентир подаются вместе, без ручной сборки коллажа в редакторе. У видеочасти Grok Imagine похожий механизм появился в конце июля, тогда речь шла о семи референсах на сцену.

Отдельный сценарий xAI показывает на связке с видео: героя, локации и предметы генерируют по очереди отдельными картинками, а модель держит единый стиль от кадра к кадру. Дальше набор идёт в видеогенератор как заготовка мира.

Смена формата достраивает кадр

Готовое изображение в Image 2.0 можно пересобрать под другое соотношение сторон, от узкой вертикали 1:2 до широкого баннера 2:1. Вместо обрезки модель дорисовывает недостающие края под новую рамку. Для одного визуала, который расходится в ленту, сторис и шапку сайта, это экономит три отдельные генерации.

Мелкий текст и плотные макеты

Заявка xAI на этот раз про аккуратность: Image 2.0 планирует типографику и раскладку так, как это делал бы дизайнер, поэтому сложные многосоставные визуалы держатся вместе, а мелкий текст выходит читаемым. Модель также сохраняет то, что подали на вход, между генерациями и правками.

Здесь нужно оговориться. Примеры под эту заявку подобрала сама компания – инфографика по типографике, план поездки по дням, схема путешествия Одиссея. Независимых проверок мелкого текста на плотных макетах пока нет, а именно на нём генераторы изображений спотыкались годами.

Пятнадцать шаблонов под типовые задачи

Вместе с моделью Grok Imagine получил шаблоны – заготовки с уже настроенным сценарием, куда остаётся подставить свои материалы. Разбиты они по назначению:

  • фото: правка снимка, коллаж, смена стиля, деловой портрет;
  • товар: смена цвета изделия, карточки для маркетплейса, замена фона;
  • маркетинг: постер, UGC-фото, макеты для мерча;
  • дизайн и игры: маскот, иконки, спрайты персонажей, предметы и элементы интерфейса;
  • стриминг: набор эмодзи.

Второе место в обоих рейтингах

По данным xAI со ссылкой на рейтинги Arena на 7 августа, Image 2.0 занимает вторую строчку и в генерации изображений по тексту, и в редактировании – по общему показателю Elo. Модели компании перечислены там под именем SpaceXAI.

Кто стоит на первой строчке, xAI не уточняет. Для релиза, построенного вокруг точности и рабочих сценариев, умолчание говорит не меньше самой цифры.

Карточки товара и обложки постов

Вебмастеру из набора пригодится вполне конкретное. Шаблон для маркетплейсов и смена цвета изделия закрывают карточки каталога, постер и мерч – обложки постов, генератор иконок – разделы сайта. Удаление фона с выгрузкой на прозрачном слое убирает лишний проход через графический редактор.

Ограничение одно, зато существенное: всё делается руками в интерфейсе Grok. Прогнать через Image 2.0 сотню карточек пакетно пока нельзя.

Без API это ручная работа

Набор инструментов Image 2.0 во многом повторяет то, что уже умеют ChatGPT Images и Adobe Firefly, и сам по себе рынок не переворачивает. Ценность в сборке: генерация, точечная правка, смена формата и готовые сценарии живут в одном окне, куда пользователь Grok и так заходит.

Точкой отсчёта станет открытие API – xAI обещает его без даты. Вторая невыясненная величина – лимиты и цена режима Quality, о которых компания не сказала ничего.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Как повторить тренд из «Форсажа» с помощью ИИ — гайд

В соцсетях завирусился ИИ-тренд по мотивам «Форсажа»: пользователи пересобирают культовые сцены из Tokyo Drift, подставляя в кадр собственные...

DeepSeek выпустила V4.1 Flash — открытую ИИ-модель с контекстом до 1 млн токенов

DeepSeek выпустила DeepSeek V4.1 Flash и открыла веса модели на Hugging Face. Она принимает текст и изображения, отвечает...

Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию,...

NotebookLM научился делать минутные вертикальные видео из документов

Google добавила в NotebookLM новый формат - Short Video Overviews. Сервис автоматически собирает из загруженных документов короткое вертикальное...

Kling представила Avatar 2.0 — длина видео до 5 минут, «чистый» липсинк и «живая» мимика 

Разработчики Kling AI (Kuaishou) выпустили модель Avatar 2.0 — обновление инструмента для создания говорящих цифровых аватаров. Релиз состоялся...

15 главных сериалов октября 2026 года, которые нельзя пропустить

Октябрь — самое время доставать плед, заваривать что-нибудь горячее и устраивать длинные вечера за просмотром сериалов. Тем более...

Сверхработоспособный Qwen 3.7 Max. Китайский ИИ, который трудится 35 часов без остановки

Среди всего того, что Alibaba представила на своем облачном саммите в мае 2026 года, флагманская языковая модель Qwen...

Нейросеть DeepSeek: регистрация, вход в личный кабинет и как пользоваться на русском бесплатно

DeepSeek – это одна из самых мощных нейросетей, доступная в России бесплатно и без VPN. Поддерживает русский язык...

ImagineArt запустила Ads Studio для генерации UGC-рекламы из ссылки на продукт

ImagineArt запустила Ads Studio - инструмент для генерации рекламных роликов из ссылки на товар. Сервис собирает UGC-видео, ролики...

DeepSeek тестирует режим «Распознавание» изображений

В интерфейсе чат-бота DeepSeek появился новый режим «Распознавание» — рядом с режимами «Быстрый» и «Эксперт». В этом режиме...

Suno выпустила v6 — три модели и редактирование песен запросами

Suno представила новое поколение моделей v6 для генерации музыки. Компания выпустила сразу три версии: основную v6, экспериментальную v6-wild...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

Pika Labs запустила Pika Agents

Pika Labs вывела Pika Agents в открытый доступ и предложила другой способ работы с генеративным ИИ. Вместо привычного...

Яндекс Люмен: что за подписка, сколько стоит, как подключить/отключить

«Яндекс Люмен» появился летом 2026 года. Сначала его запустили в Яндекс Музыке, затем добавили функции в Яндекс Книги....

OpenAI уберёт GPT-5.5 из ChatGPT и Codex 14 октября

OpenAI предупредила о завершении поддержки GPT-5.5 в ChatGPT, ChatGPT Work и Codex. Модель уберут из этих продуктов 14...

ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу

ElevenLabs представила Music v2.5 — новую версию модели для генерации музыки. Она создаёт более многослойные композиции, точнее следует...

PixVerse обновила партнёрскую программу для авторов AI-видео

PixVerse представила Global Creative Partner Program 2.0 - обновлённую партнёрскую программу для авторов AI-видео. Участникам обещают кредиты, денежные...

Выход CapCut Video Studio и интеграция Dreamina Seedance 2.0 в CapCut

CapCut представила Video Studio - новый ИИ-режим создания роликов внутри веб-версии сервиса. Продукт важен не только как очередная...

Обновление LTX Studio объединило генерацию, апскейл и цветокоррекцию

LTX Studio встроила редактирование изображений прямо в рабочее пространство проекта и тем самым сократила число лишних шагов при...