• Виктор
  • Блог
  • 2 мин. чтения

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач


DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash с 284 млрд параметров.

При генерации V4-Pro задействует 49 млрд параметров, а V4-Flash — 13 млрд. Модели уже появились в чате DeepSeek. V4-Pro работает в режиме Эксперт, V4-Flash — в Быстром. Через API они доступны как deepseek-v4-pro и deepseek-v4-flash. DeepSeek также выложила модели на Hugging Face. Подробнее в материале Postium.

Что нового в DeepSeek-V4 и что умеет нейросеть

DeepSeek-V4 построена на архитектуре Mixture-of-Experts. В такой схеме модель состоит из набора «экспертов», но для конкретного запроса использует только часть из них. Поэтому старшая V4-Pro может иметь 1,6 трлн параметров, но фактически задействовать 49 млрд при генерации.

V4-Pro рассчитана на сложные задачи: рассуждение, код, работу с длинным контекстом и запросы, где качество важнее скорости. V4-Flash — более лёгкая версия для быстрых ответов и сценариев, где важны задержка и стоимость.

Обе модели поддерживают контекст до 1 млн токенов. Это заметно для задач с большими документами, длинными переписками, кодовыми базами и агентными сценариями, где модель должна удерживать много исходных данных в одном запросе.

По собственным бенчмаркам DeepSeek, V4-Pro сильнее всего раскрывается в режиме Max. Модель набрала 93,5 на LiveCodeBench, 3206 рейтинга Codeforces, 80,6% на SWE Verified и 67,9 на Terminal Bench 2.0.

Как пользоваться DeepSeek V4

Зайдите в чат-бот DeepSeek — выбирать V4 отдельно не нужно, она работает по умолчанию. Переключение между версиями спрятано в режимах: «эксперт» включает V4-Pro, «быстрый» — V4-Flash. После этого можно сразу вводить запрос.

В DeepSeek API новые модели доступны под названиями deepseek-v4-pro и deepseek-v4-flash. Разработчики могут отдельно выбирать старшую модель для сложных запросов и Flash-версию для быстрых массовых задач.

V4-Flash стоит $0,14 за 1 млн входных токенов и $0,28 за 1 млн выходных. При попадании в кэш входные токены обходятся в $0,028 за 1 млн. V4-Pro дороже: $1,74 за 1 млн входных токенов, $3,48 за 1 млн выходных и $0,145 за входные токены при cache hit.

Почему это важно? DeepSeek разводит два сценария внутри одной линейки. V4-Pro закрывает задачи, где нужны максимальная точность и устойчивость на длинном контексте. V4-Flash подходит там, где важнее скорость ответа и цена запроса.

Главная фишка — не только на размер моделей, а на сочетание открытых весов, длинного контекста и MoE-архитектуры. DeepSeek снова пытается дать разработчикам альтернативу закрытым моделям — с возможностью развернуть или адаптировать систему под свои задачи.

DeepSeek уже выпускала открытые модели V3 и R1. V4 продолжает тот же курс: крупные MoE-модели, открытая публикация и разделение на версии для разных режимов работы.

Итог: DeepSeek-V4 добавляет в экосистему компании две модели под разные сценарии: V4-Pro — для тяжёлых задач, V4-Flash — для быстрых запросов с меньшими вычислительными затратами.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Конспект видео нейросетью: чек-лист для новичка

Часовая запись вебинара, лекция на полтора часа, интервью на YouTube, которое нужно пересказать коллеге за пять минут —...

ElevenLabs представила Studio 4.0 с генерацией видео, изображений и звука

ElevenLabs выпустила Studio 4.0 — обновлённый редактор, а также Studio Agent. В одном проекте теперь можно генерировать видео,...

adidas и Arte Antwerp выпустят две новые версии F50 Motion

adidas и бельгийский бренд Arte Antwerp представили две новые версии кроссовок F50 Motion — лакированную чёрную и серебристую....

Qwen выпустила Qwen-Image-3.0 — модель генерирует сложные макеты и текст от 10 пикселей

Qwen представила Qwen-Image-3.0 — третье поколение модели для генерации и редактирования изображений. Она принимает инструкции объёмом до 4,5...

Обновлённый Reve: свобода творчества без технических барьеров

Reve представила обновлённую платформу для генерации и редактирования изображений, стремясь сделать визуальное творчество доступным без технических барьеров. Новый...

OpenAI выпустила GPT-6 Sol и GPT-6 Luna — новые модели уже доступны в ChatGPT и Codex

OpenAI начала развёртывание GPT-6 Sol и GPT-6 Luna. Новые модели уже появляются в ChatGPT Work и Codex, а...

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений

Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом,...

Grok Imagine получил референсы персонажей и голоса: xAI добавила генерацию видео в 1080p

xAI добавила в Grok Imagine референсы: до семи опорных изображений на генерацию закрепляют лицо персонажа, товар или локацию,...

Подписка на Suno AI: тарифы, как купить из России и сколько стоит трек

Если вы открыли эту статью, то, скорее всего, уже знакомы с Suno AI: знаете, как работает нейросеть, и...

Килиан Мбаппе ушёл от Nike и стал амбассадором бренда On

Швейцарский производитель спортивной одежды и обуви On заключил контракт с нападающим «Реала» и сборной Франции Килианом Мбаппе. Футболист...

Perplexity открыла исходный код Lily — движка для локальной работы ИИ на Mac

Perplexity открыла исходный код Lily — лёгкого движка инференса для локальной работы с моделями в Perplexity Computer. Он...

Нейросеть DeepSeek: регистрация, вход в личный кабинет и как пользоваться на русском бесплатно

DeepSeek – это одна из самых мощных нейросетей, доступная в России бесплатно и без VPN. Поддерживает русский язык...

Suno выпустила Studio 2.0 — добавили поддержку MIDI и синтезатор

Suno выпустила Studio 2.0 — обновление браузерной рабочей станции для создания музыки. В ней появились MIDI-дорожки с возможностью...

Google показала проекты на Gemini 3.8 Flash

Google показала четыре проекта, собранных разработчиками на Gemini 3.8 Flash. Модель вышла в начале сентября и, по заявлению...

DeepSeek представила V4-Pro и V4-Flash — новые ИИ-модели для сложных и быстрых задач

DeepSeek представила предварительную версию линейки DeepSeek-V4. В неё вошли две MoE-модели: V4-Pro с 1,6 трлн параметров и V4-Flash...

Нейросеть Sora 2: как пользоваться, где взять инвайт, возможности, как скачать

OpenAI представила Sora 2 — новую версию своей видеомодели, которая автоматически генерирует короткие ролики со звуком и синхронной...

OpenAI выпустила GPT-6 Sol и Luna и вдвое снизила цены

OpenAI выпустила GPT-6 Sol и GPT-6 Luna, среднюю и младшую модели поколения GPT-6. Они построены на наработках флагманской...

Grok 4.7 обогнал более дорогих конкурентов в юридических задачах

SpaceXAI выпустила Grok 4.7 - флагманскую модель для программирования и долгой рабочей рутины. Она заметно прибавила против Grok...

Alibaba открыла QwenWork по всему миру — ИИ-агент работает в браузере и на компьютере

Alibaba открыла международную версию QwenWork в формате публичной беты. Это рабочая платформа с ИИ-агентом: пользователь описывает задачу обычным...

Поздравление с ИИ: что бесплатно, а что платно в 2026

Каждый раз, когда у кого-то из близких день рождения, встаёт один и тот же вопрос: написать обычное «с...