• Виктор
  • Блог
  • 2 мин. чтения

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash


30 июня Google открыла доступ к двум новым моделям генеративной графики и видео – Nano Banana 2 Lite и Gemini Omni Flash. Первая делает упор на скорость и низкую цену генерации картинок, вторая создаёт и редактирует видео обычными текстовыми командами. Обе доступны разработчикам через Google AI Studio, Gemini API и Gemini Enterprise Agent Platform.

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

Google делает ставку на нижний ценовой этаж генеративных медиа. Сразу две модели вышли в один день: лёгкая версия генератора картинок Nano Banana и видеомодель Gemini Omni Flash, которую раньше показывали только на конференции. Обе оптимизированы под одно – много, быстро, дёшево.

Картинка за 4 секунды и три цента

Nano Banana 2 Lite (системное имя gemini-3.1-flash-lite-image) – самая быстрая и дешёвая модель в семействе Nano Banana. Генерация изображения по тексту занимает 4 секунды, цена – $0,034 за картинку разрешением 1K. Google прямо называет её заменой первой версии Nano Banana (gemini-2.5-flash-image): код можно переключить уже сейчас и получить выше качество, выше скорость и ниже цену на том же месте.

Несмотря на упор на скорость, Lite держит точность следования промпту, узнаваемость персонажей от кадра к кадру и читаемый текст внутри картинки – то, на чём обычно сыплются быстрые модели. Модель доступна разработчикам в AI Studio, через Gemini API и на корпоративной платформе агентов. Параллельно её включают в потребительские продукты: режим AI в Поиске, приложение Gemini, NotebookLM , Google Photos, Stitch, Google Flow и Google Ads.

Место Lite в линейке Nano Banana

Семейство теперь делится по задачам. Nano Banana 2 Lite – про скорость и объём, когда нужны тысячи картинок и минимальная задержка. Nano Banana 2 (Gemini 3.1 Flash Image) – универсальная рабочая лошадка, баланс качества и цены. Nano Banana Pro (Gemini 3 Pro Image) – для сложных профессиональных сцен, где важнее точность, чем скорость. Первая Nano Banana ушла в статус устаревшей, и Google советует с неё съезжать.

Видео и правки на словах

Вторая модель, Gemini Omni Flash (gemini-omni-flash-preview), впервые доступна разработчикам – через Gemini API и AI Studio, а также в приложении Gemini и в Google Flow. Её показывали ещё на Google I/O, теперь это открытый предварительный доступ. Omni Flash генерирует и редактирует видео из комбинации текста, картинок и видео на входе.

Сильная сторона – правки разговором: видео можно дорабатывать обычными командами, без таймлайна и ручного монтажа. Модель опирается на общие знания Gemini (история, биология, логика повествования) и умеет привязывать текст и графику к действиям в кадре. Цена – $0,10 за секунду готового видео, столько же стоит Veo 3.1 Fast.

Что Omni Flash пока не умеет

Здесь нужно оговориться: это превью, и ограничений хватает. Длина ролика – пока 10 секунд, больше обещают позже. Загрузка аудио-референсов и продление сцены через API не поддерживаются. Видео-референсы до 3 секунд формально принимаются схемой API, но корректно моделью не обрабатываются. Сохранение персонажа при смене сцены и панорамировании работает с оговорками – в Google говорят, что дорабатывают.

Набор честный, но он же показывает зрелость: Omni Flash годится для коротких эффектных вставок, а не для связных сцен с одним героем.

Связка картинка → видео в один конвейер

Главный смысл двойного релиза – не две отдельные модели, а конвейер. Nano Banana 2 Lite быстро генерирует изображение, оно уходит референсом в Omni Flash и оживает в видео. Через Interactions API такие многошаговые сессии сохраняют историю и контекст: пользователь может сложить до трёх последовательных правок подряд. Google уже выложила демо-приложения (Anywhere, Space Lift, Omni product studio), где обе модели работают в одном потоке.

Зачем Google дешёвый этаж генмедиа

Подача всего релиза – про стоимость и объём, а не про рекорды качества. $0,034 за картинку и $0,10 за секунду видео – заявка на сегмент, где генерят пачками: прототипы, товарные карточки, рекламные креативы, интерфейсные ассеты. Там, где раньше дорогая модель съедала бюджет, Google предлагает прижать расходы и держать скорость.

Watermark SynthID встроен в обе модели – сгенерированный контент можно проверить через приложение Gemini, Gemini в Chrome и Поиск. Для рекламы и медиа это снимает часть вопросов о происхождении картинок.

Проверочной точкой станет видео. Картиночная часть выглядит готовой к продакшену уже сейчас, а вот Omni Flash с её 10 секундами и нестабильным персонажем – пока инструмент для коротких эффектов. Дозреет ли она до связных сцен – увидим, когда снимут ограничения превью.

Источник:
Google, The Keyword (блог)



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Будущий дата-центр Amazon в Техасе может стать главным источником углеродных выбросов в США

В рамках проекта дата-центра в округе Пекос, штат Техас, Amazon инвестирует в расположенную на площадке электростанцию, которая может...

Как пользоваться Nano Banana 2 Lite бесплатно — гайд

Недавно Google выпустил нейросеть Nano Banana 2 Lite — облегчённую версию генератора изображений на базе Gemini. ИИ-модель быстро...

Сбой в xAI заставил чат-бот Grok выдавать пользователям бессвязный текст

Необычный сбой привёл к тому, что чат-бот Grok компании xAI начал выдавать многим пользователям бессвязный текст. После просьбы...

OpenAI выпустила приложение Sora на Android — пока только в 7 странах

OpenAI представила Android-версию приложения Sora — инструмента для генерации коротких видео с помощью искусственного интеллекта. Скачать ИИ-генератор видео...

Kling добавила нативную генерацию в 4K в версии Video 3.0

Kling запустила режим 4K Mode в линейке Video 3.0. Теперь видео можно генерировать сразу в 4K — без...

GLM 5.3: мощнее в коде и кибербезопасности

14 августа 2026 года уже упоминавшаяся нами в предыдущих обзорах компания Zhipu AI представила следующую версию своей флагманской...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

Alibaba сообщила о падении прибыли на 75% из-за крупных инвестиций в ИИ-инфраструктуру

Китайский технологический гигант Alibaba в четверг сообщил о падении прибыли за последний квартал на 75% на фоне крупных...

Подписка на Suno AI: тарифы, как купить из России и сколько стоит трек

Если вы открыли эту статью, то, скорее всего, уже знакомы с Suno AI: знаете, как работает нейросеть, и...

YouTube позволит генерировать Shorts с помощью Veo 3

На мероприятии «Made on YouTube» 16 сентября компания представила большое обновление для Shorts и YouTube Studio. В сервис...

YouTube запустил генерацию видео с помощью Veo 2 для Shorts

YouTube представил новую функцию для генерации коротких роликов в Shorts, интегрировав ИИ-модель Veo 2 от Google в инструмент...

DeepSeek тестирует режим «Распознавание» изображений

В интерфейсе чат-бота DeepSeek появился новый режим «Распознавание» — рядом с режимами «Быстрый» и «Эксперт». В этом режиме...

Synthesia встроила агента в редактор и обновила модель аватаров

Synthesia запустила Assistant - чат-агента, который собирает ролик из промпта, документа или ссылки прямо в редакторе и правит...

OpenAI выпустила GPT-6 Sol и Luna и вдвое снизила цены

OpenAI выпустила GPT-6 Sol и GPT-6 Luna, среднюю и младшую модели поколения GPT-6. Они построены на наработках флагманской...

Suno выпустила v6 — три модели и редактирование песен запросами

Suno представила новое поколение моделей v6 для генерации музыки. Компания выпустила сразу три версии: основную v6, экспериментальную v6-wild...

ElevenLabs теперь можно подключить к Claude через MCP

ElevenLabs представила MCP-сервер для Claude. Он позволяет управлять агентами ElevenLabs из чата в Claude. Коннектор уже появился в...

Pika запустила Relight Media для изменения света в фото и видео

Pika открыла Relight Media — приложение, которое меняет освещение в готовом фото или видеоролике. Пользователь загружает файл, выбирает...

⚔️ Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Привет! Меня зовут Анатолий Чупин. Я редактор сайта Postium, исследователь ИИ и автор Telegram-канала «Промты — и точка»....

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

Claude Fable 5. Модель ИИ, которой можно сказать «разберись» и уйти пить кофе

Есть такой тип людей, которым нельзя давать простые задачи. Они все равно решат их как-то по-своему, с избыточным...