• Виктор
  • Блог
  • 3 мин. чтения

Google запускает Nano Banana – новая эра редактирования изображений


Google представила модель искусственного интеллекта Nano Banana – предварительную версию Gemini 2.5 Flash Image, которая уже доступна пользователям через мобильное приложение, API и платформу Krea. Эта разработка открывает новые горизонты в генерации и редактировании изображений с помощью простых текстовых инструкций.

Google запускает Nano Banana - новая эра редактирования изображений

26 августа 2025 года подразделение Google AI представило модель, которая может радикально изменить повседневную работу с изображениями. Под неофициальным, но быстро ставшим вирусным названием Nano Banana скрывается preview-версия новой нейросетевой архитектуры Gemini 2.5 Flash Image. 

В отличие от прошлых запусков, модель появилась без громких пресс-релизов – всё началось с публикации в X от имени Google AI Studio. Однако интерес к ней возник мгновенно.

Модель ориентирована на высокую скорость обработки, реалистичность результатов и точную интерпретацию пользовательских команд. Несмотря на статус «предпросмотра», Nano Banana уже доступна для широкой аудитории и активно тестируется как обычными пользователями, так и профессионалами. Особенно интересен тот факт, что параллельно с продуктами Google, модель уже встроена и в популярную платформу  Krea – онлайн-сервис, специализирующийся на визуальной генерации.

Что умеет Nano Banana

На первый взгляд – очередная модель для генерации изображений. Но разница – в деталях. Nano Banana позволяет:

  • Добавлять и удалять элементы на изображении с помощью текста . Например: «добавь акварельное небо» или «удали сумку с заднего плана».
  • Менять стили и композицию : от акварели до фотореализма, от портретной до изометрической перспективы.
  • Переносить сцены : тот же персонаж может «оказаться» на пляже, в магазине или на Луне – и всё это с сохранением пропорций и освещения.
  • Сохранять образы : герой остаётся узнаваемым в разных сценах, что делает модель особенно полезной для комиксов и иллюстративных серий.
  • Работать с текстом и изображениями одновременно : мультимодальный ввод позволяет загружать фото и уточнять, что именно изменить.

Пример из демонстрации: добавление астронавта-банана на фон звёздного неба. Нереалистично? Да. Но выглядит как кадр из Pixar.

Платформы: от API до Krea

Модель Gemini 2.5 Flash Image под кодовым названием Nano Banana интегрирована сразу в несколько экосистем:

  • Gemini App (веб и мобильные версии) – доступ бесплатен, обновление пришло 26 августа автоматически.
  • Gemini API – для разработчиков и стартапов. Подходит для автоматизации генерации изображений.
  • Vertex AI – решение для бизнеса: безопасное масштабирование, контроль доступа, расширенные функции.
  • Krea.ai – одна из первых сторонних платформ, где Nano Banana стала доступна. Однако здесь модель открыта только по подписке , что подчёркивает её позиционирование как профессионального инструмента.

Таким образом, Google делает технологию доступной не только в рамках своей экосистемы, но и через сторонние сервисы, усиливая её распространение.

Скорость и эффективность

По сравнению с предыдущими версиями, Nano Banana показывает до 30-кратного ускорения генерации изображений и до 4-кратного ускорения обучения, по заявлениям разработчиков. Время отклика практически мгновенное – это позволяет использовать её даже на мобильных устройствах без задержек.

Кроме того, модель поддерживает длинные текстовые подсказки (до 32 768 токенов), открывая возможности для сложных сценариев и последовательных инструкций.

Для кого это?

  • Художники и дизайнеры – возможность быстро получить визуальную идею или создать основу для дальнейшей доработки.
  • Создатели комиксов и иллюстраций – благодаря стабильной проработке персонажей от сцены к сцене.
  • Маркетологи и бизнес – генерация изображений товаров, демонстрация продукта в разных условиях, создание контента «на лету».
  • Образование – визуализация учебных материалов, исторических сцен, биологических процессов и прочего.
  • Обычные пользователи – редактирование фото «на коленке», создание обложек для соцсетей или даже мемов.

Модель позволяет создать почти всё, от банального «сделай фон светлее» до условного «переведи сцену в дух Ван Гога и добавь туда дирижабль».

Ограничения и нюансы

Как и любая preview-модель, Nano Banana не лишена ограничений:

  • Нельзя генерировать изображения с оружием или откровенным контентом – это встроенная цензура.
  • Нет поддержки генерации аудио, видео или исполняемого кода.
  • В модели отсутствует возможность обучения на пользовательских данных.
  • Дата отсечения знаний – июнь 2025 года.

Стоимость генерации через API ориентировочно $0,039 за изображение (примерно 3,6 рубля по текущему курсу), хотя использование через Gemini App и Krea остаётся бесплатным.

Перспективы

Интеграция Nano Banana в экосистему Google только начало. Ожидается, что модель будет встроена в Google Photos, Workspace и, возможно, появится как часть инструментов в YouTube и Google Docs. С учётом скорости и качества, это может стать достойной заменой традиционным редакторам изображений.

Комментарий пользователя с форума: «Это как Photoshop, только без необходимости знать, что такое «маски слоя». Я просто пишу, что хочу – и получаю результат.»



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

OpenAI выпустила GPT Image 2 и ChatGPT Images 2.0

OpenAI представила GPT Image 2 для API и одновременно обновила генерацию изображений в ChatGPT до версии Images 2.0....

Miu Miu и New Balance выпустили балетную версию кроссовок 530 SL

Miu Miu и New Balance выпустили балетки на основе 530 SL. От кроссовок модели достались шнуровка, резиновая подошва...

Поздравление с ИИ: что бесплатно, а что платно в 2026

Каждый раз, когда у кого-то из близких день рождения, встаёт один и тот же вопрос: написать обычное «с...

Новое поколение DLSS 5 от NVIDIA: революционный ИИ-рендеринг выйдет 3 сентября

Компания NVIDIA официально анонсировала технологию DLSS 5, запуск которой запланирован на 3 сентября 2026 года. Первой игрой с...

Perplexity открыла исходный код Lily — движка для локальной работы ИИ на Mac

Perplexity открыла исходный код Lily — лёгкого движка инференса для локальной работы с моделями в Perplexity Computer. Он...

Perplexity встроила слайдер вычислительных усилий в агентный сервис Computer

Perplexity добавила слайдер управления вычислительными усилиями в агентный сервис Computer. Пользователи веб-версии платформы могут выбирать глубину рассуждений и...

OpenAI стандартизировала отчёты об отклонениях и скрытом поведении ИИ-моделей

OpenAI представила фреймворк для отчётов о рассогласовании моделей (Model Misalignment Reporting Framework). Компания стандартизировала сбор данных об опасных...

Промты для создания стикеров по фото в ChatGPT, +лучшие ИИ для стикеров

С помощью ИИ теперь можно за несколько минут сделать собственный набор стикеров для Telegram, Discord или соцсетей —...

Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео

Kling AI выпустила новую ИИ-модель Kling O1 (Omni One). Это рассуждающая нейросеть, которая генерирует видео по тексту и...

Промты для новогодней ИИ-фотосессии, +подходящие нейросети

Как говорят, готовь сани зимой, а промты для новогодних ИИ-фотосессий — в ноябре. Картинки можно публиковать уже сейчас...

ByteDance выпустила Seedream 4.0 — ИИ модель для генерации изображений, обгоняющую Nano Banana

ByteDance представила Seedream 4.0 — новую модель генерации и редактирования изображений, которая работает быстрее и стабильнее конкурентов. По...

Лучшие агрегаторы нейросетей в России — 11 сервисов для генерации изображений, видео, текста

Агрегаторы ИИ в России позволяют получить доступ к ChatGPT, Claude, Gemini, Grok, Midjourney, Seedance, Kling и другим зарубежным...

OpenAI бьёт по Apple в суде: «Вы сами не защитили свои секреты»

Ходатайство OpenAI об отклонении иска Apple о коммерческой тайне — вместе с новыми судебными материалами — показывает, какую...

Claude Mythos 5. ИИ, который обычным пользователям не продадут

Существует целый класс программ, которые не рекламируют широко. Не потому, что они плохи, а ровно наоборот. Claude Mythos...

Google анонсировала Pics — ИИ-редактор для работы с изображениями

Google анонсировала Pics — новый инструмент для генерации и редактирования изображений в Google Workspace. Он работает на базе...

Wan3.0 от Alibaba превращает презентации и отчёты в 30-секундные ролики

Alibaba официально запустила Wan3.0 - видеомодель, которая делает ролик длиной до 30 секунд из текста, картинок, аудио и...

Kimi управляет сайтами из боковой панели Chrome и запоминает действия

Kimi теперь открывает сайты, нажимает кнопки и заполняет формы по просьбе, написанной в чате. Moonshot AI переименовала своё...

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

Яндекс Люмен: что за подписка, сколько стоит, как подключить/отключить

«Яндекс Люмен» появился летом 2026 года. Сначала его запустили в Яндекс Музыке, затем добавили функции в Яндекс Книги....

Yandex AI Studio позволит создавать ИИ-агентов на базе DeepSeek-V3.2

Yandex B2B Tech представила обновление Yandex AI Studio — платформы для разработки ИИ-приложений. Главное изменение: бизнес получил возможность...