• Виктор
  • Блог
  • 2 мин. чтения

Pika Labs запустила Pika Agents


Pika Labs вывела Pika Agents в открытый доступ и предложила другой способ работы с генеративным ИИ. Вместо привычного окна для промптов сервис предлагает создать собственного цифрового партнёра с голосом, внешностью и памятью, а дальше обсуждать идеи в формате обычного разговора.

Pika Labs запустила Pika Agents

Разговор вместо промпта

Pika Labs представила Pika Agents как новый интерфейс для создания контента. На сайте сервиса компания пишет, что агент получает голос, внешность, характер и постоянную память, а создавать материалы с его помощью можно через обычный диалог. Pika отдельно подаёт этот запуск как отход от классического prompt box, то есть от привычного текстового окна для команд.

По описанию компании, Pika Agent – это «persistent, portable AI Agent built to your taste», то есть постоянный и переносимый агент, настроенный под вкус пользователя. Он работает с текстом, голосом, изображениями и видео, а общаться с ним можно через веб-приложение pika.me и iOS-приложение. Android-версия, по данным FAQ, пока только в планах.

Что именно умеет агент

Пользователь создаёт агента под себя, а дальше обсуждает с ним задачу как с креативным партнёром. Pika утверждает, что агент запоминает контекст между сессиями, умеет работать с личными предпочтениями и помогает собирать результат без ручного переключения между множеством моделей и сервисов.

Сообщается, что агент может брать на себя сложные творческие задачи, а в отдельном разделе про Skills перечисляет специализированные навыки. Среди примеров – автоматический монтаж видео в заданной стилистике, генерация стикеров и другие прикладные сценарии, которые Pika обещает постепенно расширять.

Отдельный слой продукта – мультимодальность. Pika показывает поддержку текста, голоса, аудио, изображений и видео, а также перечисляет разные модели, с которыми работает экосистема агента, включая Pika Video, Kling Video, MiniMax Video, Veo 3, ChatGPT Image и другие. Компания продаёт не один генератор, а оболочку для работы с несколькими типами контента внутри одного пользовательского сценария.

Видео-чат как часть интерфейса

Идея «человеческого» общения с агентом появилась у Pika не вчера. Ещё 2 апреля компания представила PikaStream 1.0 – систему для видеочата с агентами в реальном времени. В блоге Pika говорится, что технология позволяет разговаривать с AI-агентом лицом к лицу, а сама модель генерирует персонализированное видео с частотой 24 FPS в 480p на одном H100 и с задержкой speech-to-video около 1,5 секунды.

Запуск Agents выглядит как развитие той же линии: Pika собирает интерфейс, в котором агент выглядит и ведёт себя скорее как цифровой собеседник, чем как набор форм и полей для генерации. Для аудитории креаторов это более понятная схема входа, особенно когда задача связана с роликами, референсами, стилем и быстрыми правками. Этот вывод основан на связке между страницей Pika Agents и апрельским релизом PikaStream 1.0.

Где здесь практическая польза

Для контент-креаторов и SMM-команд запуск выглядит вполне прикладно. Pika обещает, что агент берёт на себя часть механики: помнить предпочтения пользователя, ориентироваться в стиле, собирать результат через разговор и использовать нужные навыки внутри платформы. В таком подходе меньше трения на старте и меньше ручной рутины при повторяющихся задачах.

Для независимых авторов и небольших студий ценность в другом. Порог входа в видеогенерацию часто упирается не в отсутствие идей, а в сложность интерфейса: нужно понимать, какой промпт писать, какую модель выбрать, как описать стиль и где править промежуточный результат. И вот тут Pika Agents пытается спрятать эту сложность за диалогом. Проверкой здесь станет уже качество реальной работы: насколько точно агент держит вкус пользователя и насколько предсказуемо собирает итоговый ролик. Последняя часть – редакционное наблюдение на основе заявленного позиционирования продукта.

У запуска есть и открытые вопросы

При всей яркости идеи у продукта пока остаются серые зоны. На странице Pika Agents много внимания уделено образу «AI Self» и общей логике взаимодействия, однако публичных технических деталей о лимитах генерации, тарифах для тяжёлых сценариев и полном наборе доступных функций там немного. В FAQ есть подтверждение наличия веб-версии, iOS-приложения и API, а также упоминание будущих интеграций и новых Skills, но без детальной таблицы ограничений.

Есть и более широкий вопрос про сам пользовательский сценарий. Pika предлагает человеку работать с агентом, у которого есть лицо, голос, память и персональность. Для одних это упрощение творческого процесса, для других – попытка превратить инструмент в цифровое альтер эго. В 2026 году такие интерфейсы явно выходят из экспериментальной зоны и начинают конкурировать за повседневное время пользователя. Этот вывод – редакционное наблюдение, основанное на текущем позиционировании Pika Agents и PikaStream.

Реальная творческая работа

Pika Labs делает ставку на идею, что следующий шаг в генеративном ИИ связан с интерфейсом, а не только с качеством модели. Компания прямо пишет: «No more prompt box or complicated interface» и продвигает агента как творческого партнёра, который помогает делать, дорабатывать и выпускать контент через разговор.

Если эта схема окажется удобной в ежедневной работе, Pika сможет зацепить аудиторию, которой уже тесно в формате «введите промпт и ждите результат». Если же за эффектной оболочкой окажется обычный чат с набором навыков, рынок быстро это заметит. В этом запуске интересен именно сдвиг в UX: Pika продаёт человеку уже не генератор, а фигуру постоянного цифрового соавтора. 



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

Kling представил VIDEO 2.6 — ИИ-модель, которая генерирует видео и звук за один прогон

Kling запустил модель VIDEO 2.6 — свой первый генератор, который создаёт картинку и звук одновременно. Один запрос превращается...

Промты для создания стикеров по фото в ChatGPT, +лучшие ИИ для стикеров

С помощью ИИ теперь можно за несколько минут сделать собственный набор стикеров для Telegram, Discord или соцсетей —...

Сбой в xAI заставил чат-бот Grok выдавать пользователям бессвязный текст

Необычный сбой привёл к тому, что чат-бот Grok компании xAI начал выдавать многим пользователям бессвязный текст. После просьбы...

Будущий дата-центр Amazon в Техасе может стать главным источником углеродных выбросов в США

В рамках проекта дата-центра в округе Пекос, штат Техас, Amazon инвестирует в расположенную на площадке электростанцию, которая может...

Ideogram выпустила Ideogram 4.0 с открытыми весами и управлением макетом через JSON

Ideogram представила версию 4.0 - новую text-to-image модель с открытыми весами для генерации изображений, дизайна и типографики. Компания...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Miu Miu и New Balance выпустили балетную версию кроссовок 530 SL

Miu Miu и New Balance выпустили балетки на основе 530 SL. От кроссовок модели достались шнуровка, резиновая подошва...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...

OpenAI сняла лимиты на текстовые чаты в ChatGPT для всех пользователей

OpenAI объявила об отмене лимитов на текстовые чаты для всех пользователей ChatGPT. Сервис, по данным компании, недавно преодолел...

Новые фишки и функции iOS 27 для iPhone — 13 главных обновлений

Недавно Apple выпустила iOS 27 — обновление доступно для iPhone 11 и более новых моделей, а также iPhone...

DeepSeek представила DeepSeek-OCR — новую модель для сжатия визуального контекста в LLM

Компания DeepSeek показала DeepSeek-OCR — OCR-модель, созданную специально для больших языковых моделей. Вместо обычного распознавания текста она сжимает...

Comfy MCP: ComfyUI подключает ИИ-агентов к своим пайплайнам генерации

Команда ComfyUI открыла публичную бету Comfy MCP - коннектор, через который ИИ-агенты вроде Claude, Codex, Cursor и Hermes...

От Google Translate к Gemini. Новая модель приближает синхронный перевод к живому диалогу

Двадцать лет назад Google Translate был всего лишь одним из первых машинных экспериментов с языком. Сначала он переводил...

OpenAI представила GPT 5.6. Три модели, новые агенты и снижение цен

Летом 2026 года компания OpenAI представила свое новое семейство моделей под общим названием GPT 5.6. Релиз получился довольно...

NotebookLM научился делать минутные вертикальные видео из документов

Google добавила в NotebookLM новый формат - Short Video Overviews. Сервис автоматически собирает из загруженных документов короткое вертикальное...

Suno Studio 2.0 приближается к полноценной DAW благодаря поддержке MIDI и чат-боту с ИИ

Suno представила Studio 2.0 со значительными обновлениями, которые приближают ее к полноценной цифровой звуковой рабочей станции (DAW), а не к...

Qwen выпустила плагины Qwen-MM для мультимодальных ИИ-агентов

Команда Qwen опубликовала Qwen-MM-Plugins — набор открытых плагинов для работы ИИ-агентов с изображениями, видео и документами. Репозиторий поддерживает...

Нейросеть DeepSeek: регистрация, вход в личный кабинет и как пользоваться на русском бесплатно

DeepSeek – это одна из самых мощных нейросетей, доступная в России бесплатно и без VPN. Поддерживает русский язык...

20 промтов для осенней ИИ-фотосессии в нейросетях

Осенняя фотосессия не обязательно требует поездки в парк, холодной погоды и пары часов на съёмку. Если у вас...

Что изменилось в новой флагманской модели Anthropic Claude Opus 4.8

В мае 2026 года компания Anthropic обновила флагманскую модель Opus до версии 4.8. И на первый взгляд, этот...