• Виктор
  • Блог
  • 2 мин. чтения

Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям


xAI открыла общий доступ к Imagine Image 2.0 – новому режиму Quality в Grok Imagine на сайте и в мобильных приложениях. Модель правит выбранный участок картинки, снимает фон, достраивает кадр под другой формат и принимает до пяти референсов сразу.

Grok Imagine научился править картинку по кускам: xAI открыла Image 2.0 всем пользователям

Grok Imagine – визуальная часть Grok, чат-бота компании xAI, где генерируют изображения и видео. Image 2.0 – новое поколение картиночной модели, и подаёт его компания как инструмент под рабочие задачи: товарные фото, постеры, портреты, иконки, ассеты для игр. Доступ открыт сразу всем, режима ожидания и списков нет.

Волшебная палочка правит один участок

Главное изменение в Image 2.0 касается правок. Волшебная палочка меняет ту область кадра, на которую вы указали, остальное остаётся нетронутым – раньше повторная генерация переписывала картинку целиком и заодно портила то, что уже устраивало. Сегментация выделяет точные контуры объекта под замену. Удаление фона отдаёт объект на прозрачном слое, готовым к вставке в чужой макет.

Логика понятная: первая генерация редко становится финальным файлом, и Grok Imagine наконец признаёт это устройством интерфейса.

До пяти референсов за раз

Multi-ref принимает до пяти входных изображений в одной генерации – персонаж, товар, фон и стилистический ориентир подаются вместе, без ручной сборки коллажа в редакторе. У видеочасти Grok Imagine похожий механизм появился в конце июля, тогда речь шла о семи референсах на сцену.

Отдельный сценарий xAI показывает на связке с видео: героя, локации и предметы генерируют по очереди отдельными картинками, а модель держит единый стиль от кадра к кадру. Дальше набор идёт в видеогенератор как заготовка мира.

Смена формата достраивает кадр

Готовое изображение в Image 2.0 можно пересобрать под другое соотношение сторон, от узкой вертикали 1:2 до широкого баннера 2:1. Вместо обрезки модель дорисовывает недостающие края под новую рамку. Для одного визуала, который расходится в ленту, сторис и шапку сайта, это экономит три отдельные генерации.

Мелкий текст и плотные макеты

Заявка xAI на этот раз про аккуратность: Image 2.0 планирует типографику и раскладку так, как это делал бы дизайнер, поэтому сложные многосоставные визуалы держатся вместе, а мелкий текст выходит читаемым. Модель также сохраняет то, что подали на вход, между генерациями и правками.

Здесь нужно оговориться. Примеры под эту заявку подобрала сама компания – инфографика по типографике, план поездки по дням, схема путешествия Одиссея. Независимых проверок мелкого текста на плотных макетах пока нет, а именно на нём генераторы изображений спотыкались годами.

Пятнадцать шаблонов под типовые задачи

Вместе с моделью Grok Imagine получил шаблоны – заготовки с уже настроенным сценарием, куда остаётся подставить свои материалы. Разбиты они по назначению:

  • фото: правка снимка, коллаж, смена стиля, деловой портрет;
  • товар: смена цвета изделия, карточки для маркетплейса, замена фона;
  • маркетинг: постер, UGC-фото, макеты для мерча;
  • дизайн и игры: маскот, иконки, спрайты персонажей, предметы и элементы интерфейса;
  • стриминг: набор эмодзи.

Второе место в обоих рейтингах

По данным xAI со ссылкой на рейтинги Arena на 7 августа, Image 2.0 занимает вторую строчку и в генерации изображений по тексту, и в редактировании – по общему показателю Elo. Модели компании перечислены там под именем SpaceXAI.

Кто стоит на первой строчке, xAI не уточняет. Для релиза, построенного вокруг точности и рабочих сценариев, умолчание говорит не меньше самой цифры.

Карточки товара и обложки постов

Вебмастеру из набора пригодится вполне конкретное. Шаблон для маркетплейсов и смена цвета изделия закрывают карточки каталога, постер и мерч – обложки постов, генератор иконок – разделы сайта. Удаление фона с выгрузкой на прозрачном слое убирает лишний проход через графический редактор.

Ограничение одно, зато существенное: всё делается руками в интерфейсе Grok. Прогнать через Image 2.0 сотню карточек пакетно пока нельзя.

Без API это ручная работа

Набор инструментов Image 2.0 во многом повторяет то, что уже умеют ChatGPT Images и Adobe Firefly, и сам по себе рынок не переворачивает. Ценность в сборке: генерация, точечная правка, смена формата и готовые сценарии живут в одном окне, куда пользователь Grok и так заходит.

Точкой отсчёта станет открытие API – xAI обещает его без даты. Вторая невыясненная величина – лимиты и цена режима Quality, о которых компания не сказала ничего.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Anthropic выпустила Claude Opus 5.5 — модель стала быстрее и дешевле 

Anthropic выпустила Claude Opus 5.5 для Claude, Claude Code и Claude Platform. Новая модель генерирует ответы более чем...

Сверхработоспособный Qwen 3.7 Max. Китайский ИИ, который трудится 35 часов без остановки

Среди всего того, что Alibaba представила на своем облачном саммите в мае 2026 года, флагманская языковая модель Qwen...

Nvidia «достигла AGI», но никто не знает, что это значит

В среду на отчётной конференции Nvidia Дженсен Хуанг заявил, что компания «достигла AGI» — искусственного общего интеллекта, одной...

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Alibaba официально запустила Wan3.0 - видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и...

Claude Code будет работать в автоматическом режиме по умолчанию

Программирование с Claude Code вскоре будет требовать еще меньше контроля человеком: Anthropic заявила, что начиная с 14 августа сделает...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

Приложения для создания и обработки фото с помощью ИИ: топ-11 на Android/iPhone

Нужно создать аватар, улучшить старое фото или оживить снимок для соцсетей? Под каждую задачу есть свое приложение, где...

Grok 4.7 обогнал более дорогих конкурентов в юридических задачах

SpaceXAI выпустила Grok 4.7 - флагманскую модель для программирования и долгой рабочей рутины. Она заметно прибавила против Grok...

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

Alibaba представила Qwen3.8‑Max — новую флагманскую ИИ-модель с 2,4 трлн параметров. Сейчас она доступна в Qwen Studio и...

Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию,...

Обзор платформы lava.top

lava.top — это международная платформа для продажи контента, позволяющая создавать и продавать цифровые продукты без подключения дополнительных платежных...

Яндекс сводит аналитику данных в одну платформу

Yandex B2B Tech анонсировала DataLens Platform, платформу для работы с корпоративными данными от загрузки и хранения до отчётов...

Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео

Kling AI выпустила новую ИИ-модель Kling O1 (Omni One). Это рассуждающая нейросеть, которая генерирует видео по тексту и...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Конспект видео нейросетью: чек-лист для новичка

Часовая запись вебинара, лекция на полтора часа, интервью на YouTube, которое нужно пересказать коллеге за пять минут —...

OpenAI покажет человекоподобного робота в 2027 году

OpenAI планирует создать собственного человекоподобного робота. Об этом глава компании Сэм Альтман рассказал в начале сентября. Ранее Альтман...

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон

Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается...

Google запустила Pics — ИИ-редактор изображений на базе Nano Banana

Google начала постепенно открывать доступ к Google Pics — новому ИИ-редактору изображений для Google Workspace на базе модели...

OpenAI выпустила GPT Image 2 и ChatGPT Images 2.0

OpenAI представила GPT Image 2 для API и одновременно обновила генерацию изображений в ChatGPT до версии Images 2.0....

Подписка на Suno AI: тарифы, как купить из России и сколько стоит трек

Если вы открыли эту статью, то, скорее всего, уже знакомы с Suno AI: знаете, как работает нейросеть, и...