• Виктор
  • Блог
  • 3 мин. чтения

Google запускает Nano Banana – новая эра редактирования изображений


Google представила модель искусственного интеллекта Nano Banana – предварительную версию Gemini 2.5 Flash Image, которая уже доступна пользователям через мобильное приложение, API и платформу Krea. Эта разработка открывает новые горизонты в генерации и редактировании изображений с помощью простых текстовых инструкций.

Google запускает Nano Banana - новая эра редактирования изображений

26 августа 2025 года подразделение Google AI представило модель, которая может радикально изменить повседневную работу с изображениями. Под неофициальным, но быстро ставшим вирусным названием Nano Banana скрывается preview-версия новой нейросетевой архитектуры Gemini 2.5 Flash Image. 

В отличие от прошлых запусков, модель появилась без громких пресс-релизов – всё началось с публикации в X от имени Google AI Studio. Однако интерес к ней возник мгновенно.

Модель ориентирована на высокую скорость обработки, реалистичность результатов и точную интерпретацию пользовательских команд. Несмотря на статус «предпросмотра», Nano Banana уже доступна для широкой аудитории и активно тестируется как обычными пользователями, так и профессионалами. Особенно интересен тот факт, что параллельно с продуктами Google, модель уже встроена и в популярную платформу  Krea – онлайн-сервис, специализирующийся на визуальной генерации.

Что умеет Nano Banana

На первый взгляд – очередная модель для генерации изображений. Но разница – в деталях. Nano Banana позволяет:

  • Добавлять и удалять элементы на изображении с помощью текста . Например: «добавь акварельное небо» или «удали сумку с заднего плана».
  • Менять стили и композицию : от акварели до фотореализма, от портретной до изометрической перспективы.
  • Переносить сцены : тот же персонаж может «оказаться» на пляже, в магазине или на Луне – и всё это с сохранением пропорций и освещения.
  • Сохранять образы : герой остаётся узнаваемым в разных сценах, что делает модель особенно полезной для комиксов и иллюстративных серий.
  • Работать с текстом и изображениями одновременно : мультимодальный ввод позволяет загружать фото и уточнять, что именно изменить.

Пример из демонстрации: добавление астронавта-банана на фон звёздного неба. Нереалистично? Да. Но выглядит как кадр из Pixar.

Платформы: от API до Krea

Модель Gemini 2.5 Flash Image под кодовым названием Nano Banana интегрирована сразу в несколько экосистем:

  • Gemini App (веб и мобильные версии) – доступ бесплатен, обновление пришло 26 августа автоматически.
  • Gemini API – для разработчиков и стартапов. Подходит для автоматизации генерации изображений.
  • Vertex AI – решение для бизнеса: безопасное масштабирование, контроль доступа, расширенные функции.
  • Krea.ai – одна из первых сторонних платформ, где Nano Banana стала доступна. Однако здесь модель открыта только по подписке , что подчёркивает её позиционирование как профессионального инструмента.

Таким образом, Google делает технологию доступной не только в рамках своей экосистемы, но и через сторонние сервисы, усиливая её распространение.

Скорость и эффективность

По сравнению с предыдущими версиями, Nano Banana показывает до 30-кратного ускорения генерации изображений и до 4-кратного ускорения обучения, по заявлениям разработчиков. Время отклика практически мгновенное – это позволяет использовать её даже на мобильных устройствах без задержек.

Кроме того, модель поддерживает длинные текстовые подсказки (до 32 768 токенов), открывая возможности для сложных сценариев и последовательных инструкций.

Для кого это?

  • Художники и дизайнеры – возможность быстро получить визуальную идею или создать основу для дальнейшей доработки.
  • Создатели комиксов и иллюстраций – благодаря стабильной проработке персонажей от сцены к сцене.
  • Маркетологи и бизнес – генерация изображений товаров, демонстрация продукта в разных условиях, создание контента «на лету».
  • Образование – визуализация учебных материалов, исторических сцен, биологических процессов и прочего.
  • Обычные пользователи – редактирование фото «на коленке», создание обложек для соцсетей или даже мемов.

Модель позволяет создать почти всё, от банального «сделай фон светлее» до условного «переведи сцену в дух Ван Гога и добавь туда дирижабль».

Ограничения и нюансы

Как и любая preview-модель, Nano Banana не лишена ограничений:

  • Нельзя генерировать изображения с оружием или откровенным контентом – это встроенная цензура.
  • Нет поддержки генерации аудио, видео или исполняемого кода.
  • В модели отсутствует возможность обучения на пользовательских данных.
  • Дата отсечения знаний – июнь 2025 года.

Стоимость генерации через API ориентировочно $0,039 за изображение (примерно 3,6 рубля по текущему курсу), хотя использование через Gemini App и Krea остаётся бесплатным.

Перспективы

Интеграция Nano Banana в экосистему Google только начало. Ожидается, что модель будет встроена в Google Photos, Workspace и, возможно, появится как часть инструментов в YouTube и Google Docs. С учётом скорости и качества, это может стать достойной заменой традиционным редакторам изображений.

Комментарий пользователя с форума: «Это как Photoshop, только без необходимости знать, что такое «маски слоя». Я просто пишу, что хочу – и получаю результат.»



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

ElevenLabs добавила генерацию речи, музыки, изображений и видео в MCP

ElevenLabs расширила свой MCP-сервер. Теперь подключённый ИИ-ассистент может создавать речь, музыку, звуковые эффекты, изображения и видео, а также...

ElevenLabs теперь можно подключить к Claude через MCP

ElevenLabs представила MCP-сервер для Claude. Он позволяет управлять агентами ElevenLabs из чата в Claude. Коннектор уже появился в...

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон

Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается...

Google анонсировала Pics — ИИ-редактор для работы с изображениями

Google анонсировала Pics — новый инструмент для генерации и редактирования изображений в Google Workspace. Он работает на базе...

Anthropic объединила чат с Cowork и встроила редакторы документов и слайдов прямо в Claude

Anthropic объединила стандартный диалоговый чат и рабочий режим Cowork в единый интерфейс Claude. Модель теперь сама определяет характер...

15 главных сериалов октября 2026 года, которые нельзя пропустить

Октябрь — самое время доставать плед, заваривать что-нибудь горячее и устраивать длинные вечера за просмотром сериалов. Тем более...

Suno выпустила v6 — три модели и редактирование песен запросами

Suno представила новое поколение моделей v6 для генерации музыки. Компания выпустила сразу три версии: основную v6, экспериментальную v6-wild...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

Kling AI выпустила Skill для генерации видео через ИИ-агентов

Kling AI запустила Kling Skills Suite — инструмент, который подключается к сторонним AI-агентам и даёт им доступ к...

Гайд по размерам для YouTube: шапка канала, обложка видео, Shorts, аватар, лого

Если вы загружаете ролики на YouTube и оформляете канал, размеры лучше определить заранее. Иначе шапка обрежется на смартфоне,...

DeepSeek представила DeepSeek-OCR — новую модель для сжатия визуального контекста в LLM

Компания DeepSeek показала DeepSeek-OCR — OCR-модель, созданную специально для больших языковых моделей. Вместо обычного распознавания текста она сжимает...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

Kling представила Avatar 2.0 — длина видео до 5 минут, «чистый» липсинк и «живая» мимика 

Разработчики Kling AI (Kuaishou) выпустили модель Avatar 2.0 — обновление инструмента для создания говорящих цифровых аватаров. Релиз состоялся...

ElevenLabs выпустили Eleven v4 и v4 Turbo — ИИ для озвучки с управлением эмоциями и манерой речи

ElevenLabs представила новые модели синтеза речи Eleven v4 и Eleven v4 Turbo. Они построены на новой архитектуре и...

MiniMax Hub добавил аудиомодели и готовые процессы для производства видео

MiniMax обновила творческую платформу MiniMax Hub. В ней появились аудиомодели ElevenLabs Music v2 и Seed Audio 1.0, готовые...

ByteDance выпустила Seedream 4.0 — ИИ модель для генерации изображений, обгоняющую Nano Banana

ByteDance представила Seedream 4.0 — новую модель генерации и редактирования изображений, которая работает быстрее и стабильнее конкурентов. По...

Suno вводит лимиты на скачивание — до 7 треков бесплатно

Suno объявила, что с 3 сентября введёт лимиты на скачивание созданной музыки. На бесплатном тарифе пользователи, зарегистрировавшиеся до...

Лимиты использования в ChatGPT/Codex: где посмотреть и как сбросить

Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы...

YouTube запустил генерацию видео с помощью Veo 2 для Shorts

YouTube представил новую функцию для генерации коротких роликов в Shorts, интегрировав ИИ-модель Veo 2 от Google в инструмент...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...