• Виктор
  • Блог
  • 2 мин. чтения

ElevenLabs выпустили Eleven v4 и v4 Turbo — ИИ для озвучки с управлением эмоциями и манерой речи


ElevenLabs представила новые модели синтеза речи Eleven v4 и Eleven v4 Turbo. Они построены на новой архитектуре и рассчитаны на создание более выразительной озвучки с управлением эмоциями, темпом и манерой подачи прямо в тексте.

Eleven v4 создавали специально для контента, аудиокниг, озвучки персонажей и других сценариев, где важнее всего качество. Версия v4 Turbo сохраняет выразительность основной модели, но оптимизирована для работы в реальном времени — в частности, с голосовыми агентами. По данным ElevenLabs, её медианная задержка инференса составляет около 100 мс, а время до первого звука — около 150 мс.

Нейросеть Eleven v4: что умеет и как работает

Одно из ключевых изменений — более точное управление подачей. В текст можно добавлять аудиотеги вроде [whispering], [shouting], [laughing], [sigh] и задавать, как должна звучать конкретная реплика. Модель также учитывает контекст сцены, поэтому может менять эмоциональную подачу в рамках одного текста. ElevenLabs отмечает, что v4 надёжнее следует последовательностям тегов, чем предыдущая версия.

Для длинных материалов используется контекстное сшивание: оно помогает сохранять темп и характер подачи между отдельными генерациями. Компания также заявляет, что голос остаётся стабильным при повторной генерации отдельных фрагментов, что упрощает работу с диалогами и длинной озвучкой.

Клонирование голоса и языки

Eleven v4 поддерживает Instant Voice Cloning — голос можно клонировать по записи длительностью от 10 секунд. Также модель снова поддерживает Professional Voice Clones, которые рассчитаны на более точное воспроизведение исходного голоса. Для использования клона требуется подтверждённое согласие владельца голоса.

Модель работает более чем с 90 языками, включая русский. ElevenLabs отдельно указывает, что v4 может генерировать речь на поддерживаемых языках с одним и тем же голосом.

Eleven v4 и v4 Turbo доступны через ElevenCreative, ElevenAgents и ElevenAPI. Для API предусмотрены как потоковая, так и обычная генерация речи.

Ранее ElevenLabs представила Studio 4.0 с генерацией видео, изображений и звука.

Изображения: elevenlabs.io



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Veo 3.1 уже доступна на WaveSpeedAI — создаёт видео из текста и картинок

Платформа WaveSpeedAI представила интеграцию с новой моделью Google Veo 3.1 — одной из самых продвинутых ИИ-моделей для генерации...

Suno Studio 2.0 приближается к полноценной DAW благодаря поддержке MIDI и чат-боту с ИИ

Suno представила Studio 2.0 со значительными обновлениями, которые приближают ее к полноценной цифровой звуковой рабочей станции (DAW), а не к...

ElevenLabs запустила Flows Agent в ElevenCreative — агент строит workflow по текстовому запросу

ElevenLabs представила Flows Agent в ElevenCreative. Пользователь описывает, что хочет создать, а ИИ-агент подбирает модели, добавляет узлы на...

Apple ведёт переговоры с издателями о выплатах за актуальные новости для Siri

Согласно информации The Wall Street Journal, Apple ведёт переговоры о выплатах издателям за использование их контента для работы будущего...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...

Google запускает Nano Banana – новая эра редактирования изображений

Google представила модель искусственного интеллекта Nano Banana - предварительную версию Gemini 2.5 Flash Image, которая уже доступна пользователям...

Anthropic объединила чат с Cowork и встроила редакторы документов и слайдов прямо в Claude

Anthropic объединила стандартный диалоговый чат и рабочий режим Cowork в единый интерфейс Claude. Модель теперь сама определяет характер...

Вышел Kling O1 — рассуждающая нейросеть для генерации и редактирования видео

Kling AI выпустила новую ИИ-модель Kling O1 (Omni One). Это рассуждающая нейросеть, которая генерирует видео по тексту и...

Килиан Мбаппе ушёл от Nike и стал амбассадором бренда On

Швейцарский производитель спортивной одежды и обуви On заключил контракт с нападающим «Реала» и сборной Франции Килианом Мбаппе. Футболист...

Сбой в xAI заставил чат-бот Grok выдавать пользователям бессвязный текст

Необычный сбой привёл к тому, что чат-бот Grok компании xAI начал выдавать многим пользователям бессвязный текст. После просьбы...

Google выпустила Nano Banana 2 Lite — быструю модель для генерации изображений через Gemini API

Google выпустила Nano Banana 2 Lite (gemini-3.1-flash-lite-image) — новую модель для генерации и редактирования изображений. Это самая быстрая...

Claude Code ушёл в облако: Anthropic открыла облачные сессии для всех и раздаёт до $250 на тест

24 сентября 2026 года Anthropic перевела облачные сессии Claude Code в общий доступ. Раньше функция работала в статусе...

Alibaba выпустила Qwen-Image 2.1 с генерацией прозрачных изображений

Команда Qwen выпустила Qwen-Image 2.1 — модель для генерации и редактирования изображений. Веса опубликованы 20 сентября 2026 года...

YouTube позволит генерировать Shorts с помощью Veo 3

На мероприятии «Made on YouTube» 16 сентября компания представила большое обновление для Shorts и YouTube Studio. В сервис...

Runway показала GWM Worlds 2 – интерактивный мир вместо видеоролика

Runway 3 сентября показала GWM Worlds 2 - мировую модель, которая выдаёт живое интерактивное пространство вместо готового ролика....

adidas и Arte Antwerp выпустят две новые версии F50 Motion

adidas и бельгийский бренд Arte Antwerp представили две новые версии кроссовок F50 Motion — лакированную чёрную и серебристую....

Что изменилось в новой флагманской модели Anthropic Claude Opus 4.8

В мае 2026 года компания Anthropic обновила флагманскую модель Opus до версии 4.8. И на первый взгляд, этот...

PixVerse обновила партнёрскую программу для авторов AI-видео

PixVerse представила Global Creative Partner Program 2.0 - обновлённую партнёрскую программу для авторов AI-видео. Участникам обещают кредиты, денежные...

Как пользоваться Nano Banana 2 Lite бесплатно — гайд

Недавно Google выпустил нейросеть Nano Banana 2 Lite — облегчённую версию генератора изображений на базе Gemini. ИИ-модель быстро...

ByteDance выпустила Seedream 5.0 Pro для инфографики и точного редактирования изображений

ByteDance Seed 8 июля 2026 года представила Seedream 5.0 Pro - мультимодальную модель для генерации и редактирования изображений....