• Виктор
  • Блог
  • 2 мин. чтения

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash


30 июня Google открыла доступ к двум новым моделям генеративной графики и видео – Nano Banana 2 Lite и Gemini Omni Flash. Первая делает упор на скорость и низкую цену генерации картинок, вторая создаёт и редактирует видео обычными текстовыми командами. Обе доступны разработчикам через Google AI Studio, Gemini API и Gemini Enterprise Agent Platform.

Google выпустила Nano Banana 2 Lite и Gemini Omni Flash

Google делает ставку на нижний ценовой этаж генеративных медиа. Сразу две модели вышли в один день: лёгкая версия генератора картинок Nano Banana и видеомодель Gemini Omni Flash, которую раньше показывали только на конференции. Обе оптимизированы под одно – много, быстро, дёшево.

Картинка за 4 секунды и три цента

Nano Banana 2 Lite (системное имя gemini-3.1-flash-lite-image) – самая быстрая и дешёвая модель в семействе Nano Banana. Генерация изображения по тексту занимает 4 секунды, цена – $0,034 за картинку разрешением 1K. Google прямо называет её заменой первой версии Nano Banana (gemini-2.5-flash-image): код можно переключить уже сейчас и получить выше качество, выше скорость и ниже цену на том же месте.

Несмотря на упор на скорость, Lite держит точность следования промпту, узнаваемость персонажей от кадра к кадру и читаемый текст внутри картинки – то, на чём обычно сыплются быстрые модели. Модель доступна разработчикам в AI Studio, через Gemini API и на корпоративной платформе агентов. Параллельно её включают в потребительские продукты: режим AI в Поиске, приложение Gemini, NotebookLM , Google Photos, Stitch, Google Flow и Google Ads.

Место Lite в линейке Nano Banana

Семейство теперь делится по задачам. Nano Banana 2 Lite – про скорость и объём, когда нужны тысячи картинок и минимальная задержка. Nano Banana 2 (Gemini 3.1 Flash Image) – универсальная рабочая лошадка, баланс качества и цены. Nano Banana Pro (Gemini 3 Pro Image) – для сложных профессиональных сцен, где важнее точность, чем скорость. Первая Nano Banana ушла в статус устаревшей, и Google советует с неё съезжать.

Видео и правки на словах

Вторая модель, Gemini Omni Flash (gemini-omni-flash-preview), впервые доступна разработчикам – через Gemini API и AI Studio, а также в приложении Gemini и в Google Flow. Её показывали ещё на Google I/O, теперь это открытый предварительный доступ. Omni Flash генерирует и редактирует видео из комбинации текста, картинок и видео на входе.

Сильная сторона – правки разговором: видео можно дорабатывать обычными командами, без таймлайна и ручного монтажа. Модель опирается на общие знания Gemini (история, биология, логика повествования) и умеет привязывать текст и графику к действиям в кадре. Цена – $0,10 за секунду готового видео, столько же стоит Veo 3.1 Fast.

Что Omni Flash пока не умеет

Здесь нужно оговориться: это превью, и ограничений хватает. Длина ролика – пока 10 секунд, больше обещают позже. Загрузка аудио-референсов и продление сцены через API не поддерживаются. Видео-референсы до 3 секунд формально принимаются схемой API, но корректно моделью не обрабатываются. Сохранение персонажа при смене сцены и панорамировании работает с оговорками – в Google говорят, что дорабатывают.

Набор честный, но он же показывает зрелость: Omni Flash годится для коротких эффектных вставок, а не для связных сцен с одним героем.

Связка картинка → видео в один конвейер

Главный смысл двойного релиза – не две отдельные модели, а конвейер. Nano Banana 2 Lite быстро генерирует изображение, оно уходит референсом в Omni Flash и оживает в видео. Через Interactions API такие многошаговые сессии сохраняют историю и контекст: пользователь может сложить до трёх последовательных правок подряд. Google уже выложила демо-приложения (Anywhere, Space Lift, Omni product studio), где обе модели работают в одном потоке.

Зачем Google дешёвый этаж генмедиа

Подача всего релиза – про стоимость и объём, а не про рекорды качества. $0,034 за картинку и $0,10 за секунду видео – заявка на сегмент, где генерят пачками: прототипы, товарные карточки, рекламные креативы, интерфейсные ассеты. Там, где раньше дорогая модель съедала бюджет, Google предлагает прижать расходы и держать скорость.

Watermark SynthID встроен в обе модели – сгенерированный контент можно проверить через приложение Gemini, Gemini в Chrome и Поиск. Для рекламы и медиа это снимает часть вопросов о происхождении картинок.

Проверочной точкой станет видео. Картиночная часть выглядит готовой к продакшену уже сейчас, а вот Omni Flash с её 10 секундами и нестабильным персонажем – пока инструмент для коротких эффектов. Дозреет ли она до связных сцен – увидим, когда снимут ограничения превью.

Источник:
Google, The Keyword (блог)



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

adidas и Arte Antwerp выпустят две новые версии F50 Motion

adidas и бельгийский бренд Arte Antwerp представили две новые версии кроссовок F50 Motion — лакированную чёрную и серебристую....

Pika запустила Relight Media для изменения света в фото и видео

Pika открыла Relight Media — приложение, которое меняет освещение в готовом фото или видеоролике. Пользователь загружает файл, выбирает...

Runway выпустила Aleph 2.0: точечное ИИ-редактирование видео по одному кадру

Американская компания Runway представила Aleph 2.0 - крупное обновление своей ИИ-модели для точечного изменения видеоматериалов. Инструмент, встроенный в...

Google научила Antigravity SDK работать с локальными моделями без интернета

Google научила Antigravity SDK запускать ИИ-агентов на локальных моделях, в том числе без интернета. Первой поддержана открытая Gemma...

Razer выпустила одноручный кейпад Tartarus V2 Pro

Razer начала продажи Tartarus V2 Pro — одноручного игрового кейпада с 31 программируемым элементом управления. Устройство рассчитано на...

Проверка текста нейросетью: частые ошибки новичков

Люди приходят к нейросети с текстом так же, как раньше несли его редактору: «вот, посмотри, всё ли нормально»....

«Звук» запустил «Атлас» — интерактивную карту музыкального вкуса

Музыкальный сервис «Звук» запустил «Атлас» — персональную карту, которая показывает любимые жанры и настроения пользователя. На ней можно...

OpenAI интегрировала ChatGPT в Microsoft Word через общую офисную надстройку

OpenAI выпустила интеграцию ChatGPT для текстового редактора Microsoft Word. Инструмент встраивается в боковую панель программы и доступен на...

Grok научился расшифровывать речь вдвое точнее и за те же деньги

SpaceXAI выпустила Grok Voice Transcribe 2.0, модель для перевода речи в текст. По внутренним тестам компании она вдвое...

Claude Code будет работать в автоматическом режиме по умолчанию

Программирование с Claude Code вскоре будет требовать еще меньше контроля человеком: Anthropic заявила, что начиная с 14 августа сделает...

Kling 4.0 выйдет в октябре, а Flash уже доступна подписчикам Ultra

Kling AI анонсировала видеомодель Kling 4.0 с выходом в октябре, а облегчённая Kling 4.0 Flash уже работает у...

OpenAI снова столкнулась с неконтролируемым поведением ИИ-агентов

OpenAI оказалась в центре ещё одного инцидента с роем ИИ-агентов. По словам исследователей, внутренние агенты компании в мае...

Suno выпустила Studio 2.0 — добавили поддержку MIDI и синтезатор

Suno выпустила Studio 2.0 — обновление браузерной рабочей станции для создания музыки. В ней появились MIDI-дорожки с возможностью...

Nvidia «достигла AGI», но никто не знает, что это значит

В среду на отчётной конференции Nvidia Дженсен Хуанг заявил, что компания «достигла AGI» — искусственного общего интеллекта, одной...

Яндекс Люмен: что за подписка, сколько стоит, как подключить/отключить

«Яндекс Люмен» появился летом 2026 года. Сначала его запустили в Яндекс Музыке, затем добавили функции в Яндекс Книги....

Qwen выпустила плагины Qwen-MM для мультимодальных ИИ-агентов

Команда Qwen опубликовала Qwen-MM-Plugins — набор открытых плагинов для работы ИИ-агентов с изображениями, видео и документами. Репозиторий поддерживает...

Kling AI выпустила Skill для генерации видео через ИИ-агентов

Kling AI запустила Kling Skills Suite — инструмент, который подключается к сторонним AI-агентам и даёт им доступ к...

Sora 2 увеличила длину видео до 25 секунд и позволила прописывать сценарий по кадрам

Компания OpenAI обновила видеогенератор «Sora 2»: базовые пользователи теперь могут создавать ролики до 15 секунд, а подписчики «ChatGPT...

OpenAI выпустила ChatGPT Images 2.5 — генерация стала быстрее, а изображения можно точечно доработать

OpenAI выпустила ChatGPT Images 2.5 — обновлённую модель для генерации и редактирования изображений в ChatGPT. Компания заявляет, что...

Pika превратила генератор видео в платформу с набором приложений и мультимодельным стеком

Компания Pika запустила обновленную креативную платформу на pika.art. Сервис перестроили вокруг специализированных мини-приложений для видеомонтажа, ретуши и работы...