• Виктор
  • Блог
  • 2 мин. чтения

ByteDance выпустила Seedream 4.0 — ИИ модель для генерации изображений, обгоняющую Nano Banana


ByteDance представила Seedream 4.0 — новую модель генерации и редактирования изображений, которая работает быстрее и стабильнее конкурентов. По заявлениям компании, это прорыв для дизайнеров, маркетологов и разработчиков, а также серьёзный вызов Google DeepMind и его Nano Banana.

ByteDance выпустила Seedream 4.0 — ИИ модель для генерации изображений, обгоняющую Nano Banana

Компания ByteDance, известная как владелец TikTok, представила обновлённую версию своей модели Seedream 4.0 . Этот инструмент объединяет генерацию изображений по текстовому описанию и их редактирование в единой архитектуре. В отличие от предыдущих решений, где задачи обрабатывались отдельно, новая система позволяет выполнять сложные операции в одном шаге, что сокращает время и снижает количество артефактов.

Seedream 4.0 работает на базе архитектуры Mixture of Experts (MoE), которая оптимизирует баланс между скоростью и качеством. Модель способна создавать изображения в разрешении 2K менее чем за две секунды и поддерживает 4K-рендеринг в реальном времени. Она также обеспечивает стабильное воспроизведение персонажей при многократной генерации, а это важный фактор для комиксов и видеоигр.

Среди ключевых возможностей: редактирование изображения по текстовому запросу, смена фона, удаление объектов, стилизация под разные жанры (например, акварель или киберпанк). Пользователи могут загружать до шести референсных картинок и получать до девяти результатов за один проход. Модель также справляется со сложными мультимодальными задачами, включая построение графиков, уравнений и карт.

По результатам внутренних тестов ByteDance, Seedream 4.0 показала лидерство в MagicBench по соответствию промптам, эстетике и качеству редактирования. Разработчики утверждают, что модель способна превращать, например, фото гонконгского парома Star Ferry в детализированный космический корабль на фоне червоточины.

MagicBench Multi-Dimensional Evaluation

Компания прямо сравнивает новинку с моделью Nano Banana ( Gemini 2.5 Flash Image) от Google DeepMind и заявляет о превосходстве по скорости, стабильности и качеству рендера. Seedream 4.0 заняла первое место в рейтинге Elo среди аналогичных инструментов.

Новая версия уже доступна через API и партнёрские сервисы: seed.bytedance.com, Fal.ai, Flux-ai.io (ограниченно бесплатно) и Imagine.art. Стоимость составляет около 30 долларов (примерно 2700 рублей) за тысячу генераций. В будущем ByteDance планирует интеграцию Seedream в мобильные приложения и расширение функций для видео.

«Мы хотим, чтобы Seedream стала инструментом не только для художников, но и для бизнеса, образования и массового контента»,

— сообщили в ByteDance.

Таким образом, компания укрепляет позиции в глобальной гонке ИИ, где лидерами традиционно считались OpenAI и Google. Для азиатского рынка и аудитории TikTok Seedream 4.0 может стать новым стандартом в создании визуального контента.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Как пользоваться Nano Banana 2 Lite бесплатно — гайд

Недавно Google выпустил нейросеть Nano Banana 2 Lite — облегчённую версию генератора изображений на базе Gemini. ИИ-модель быстро...

ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу

ElevenLabs представила Music v2.5 — новую версию модели для генерации музыки. Она создаёт более многослойные композиции, точнее следует...

ByteDance открыла публичный API Seedance 2.5

7 августа Volcano Engine открыла публичный API Seedance 2.5 - видеомодели ByteDance, которая одним проходом собирает 30-секундный ролик...

Claude Code будет работать в автоматическом режиме по умолчанию

Программирование с Claude Code вскоре будет требовать еще меньше контроля человеком: Anthropic заявила, что начиная с 14 августа сделает...

OpenAI интегрировала ChatGPT в Microsoft Word через общую офисную надстройку

OpenAI выпустила интеграцию ChatGPT для текстового редактора Microsoft Word. Инструмент встраивается в боковую панель программы и доступен на...

Midjourney V8.1 ускорилась и вернула стиль

Midjourney выпустила альфа-версию V8.1, в которой разработчики сделали ставку на баланс: вернули фирменный визуальный стиль, ускорили генерацию и...

GLM 5.2. Мощная модель в открытом доступе

Китайская компания Zhipu AI, которая на международном рынке работает под именем Z.ai, этим летом выпустила новую большую языковую...

Gemini взломала три компании на испытаниях и остановилась сама

Gemini во время майских кибериспытаний вошла в системы трёх реальных компаний. В одном случае модель подобрала пароль, в...

Выход CapCut Video Studio и интеграция Dreamina Seedance 2.0 в CapCut

CapCut представила Video Studio - новый ИИ-режим создания роликов внутри веб-версии сервиса. Продукт важен не только как очередная...

OpenAI выпустила ChatGPT Images 2.5 — генерация стала быстрее, а изображения можно точечно доработать

OpenAI выпустила ChatGPT Images 2.5 — обновлённую модель для генерации и редактирования изображений в ChatGPT. Компания заявляет, что...

DeepSeek выпустила Harness v0.2 — приложение для macOS и Windows

У ИИ-агента DeepSeek Harness появилась настольная версия. Теперь его можно установить как обычную программу и поручать ему работу...

Лучшие агрегаторы нейросетей в России — 11 сервисов для генерации изображений, видео, текста

Агрегаторы ИИ в России позволяют получить доступ к ChatGPT, Claude, Gemini, Grok, Midjourney, Seedance, Kling и другим зарубежным...

Консистентность персонажей и стилей в нейросетях — что это и как сохранить

Представьте: вы потратили битый час на промт и наконец получили идеального персонажа. Делаете следующий шаг — просите его...

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Google теперь позволит пользователям удалять видимый водяной знак со своих ИИ-генераций

В пятницу Google объявила, что теперь позволит пользователям удалять видимый водяной знак со своих материалов, созданных ИИ, включая...

OpenAI уберёт GPT-5.5 из ChatGPT и Codex 14 октября

OpenAI предупредила о завершении поддержки GPT-5.5 в ChatGPT, ChatGPT Work и Codex. Модель уберут из этих продуктов 14...

От Google Translate к Gemini. Новая модель приближает синхронный перевод к живому диалогу

Двадцать лет назад Google Translate был всего лишь одним из первых машинных экспериментов с языком. Сначала он переводил...

Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию,...

Конспект видео нейросетью: чек-лист для новичка

Часовая запись вебинара, лекция на полтора часа, интервью на YouTube, которое нужно пересказать коллеге за пять минут —...