• Виктор
  • Блог
  • 2 мин. чтения

Sakana Fugu: ИИ, который учится управлять другими ИИ


22 июня 2026 года японская лаборатория Sakana AI (Токио) представила свой новый коммерческий продукт под названием Sakana Fugu. Компанию основали Дэвид Ха, бывший директор по исследованиям в Google Brain и Ллион Джонс, один из авторов знаменитой научной статьи. Эта статья известна тем, что когда-то именно она положила начало архитектуре трансформеров, лежащей в основе почти всех современных языковых моделей. С самого начала своей работы эта команда придерживалась не совсем обычной для отрасли идеи: вместо того, чтобы бесконечно наращивать размер одной гигантской модели, лучше научить несколько разных моделей грамотно работать вместе. То есть, создать некий ансамбль, работающий подобно стае рыб или колонии муравьев, которые в природе решают слишком сложные для отдельного существа задачи выживания. Именно из этой философии и родился новый продукт, о котором мы и поговорим вместе с командой проекта Креатор Проджект.

Из чего на самом деле состоит нейросеть

По сути, Sakana Fugu представляет собой не отдельную большую нейросеть в привычном понимании этого слова. По большей части это собранные вместе уже существующие передовые модели других компаний. Однако при этом пользователь обращается к системе точно так же, как обратился бы к любой обычной языковой модели. Он отправляет запрос через единый программный интерфейс, а внутри система сама решает, как лучше справиться с задачей. К примеру, она может ответить напрямую, если задача простая. А может собрать целую команду из нескольких разных моделей и координировать их совместную работу, если задача сложная и многоступенчатая. Все эти внутренние сложности остаются полностью скрытыми от пользователя. Внешне процесс по-прежнему выглядит как обращение к одной-единственной модели.

Как Fugu координирует другие модели

Технически сама Sakana Fugu тоже является языковой моделью, только устроена она иначе, чем привычные большие модели. Ее специально обучили решать, когда стоит делегировать часть задачи другим моделям, как эти модели должны обмениваться информацией между собой и как затем объединить их отдельные результаты в один связный и надежный ответ. Интересная деталь заключается в том, что в процессе такой координации Fugu может вызывать даже саму себя, что позволяет ей тратить больше времени и вычислительных ресурсов на особенно сложные части задачи. Данная идея опирается на два научных исследования компании, представленные в этом году на крупной международной конференции по машинному обучению.

При запуске компания предложила пользователям на выбор две версии продукта. Обычная версия под названием Fugu старается найти баланс между качеством ответов и скоростью работы. Поэтому она хорошо подходит для повседневных задач вроде написания и проверки программного кода или общения с чат-ботом. Тем командам, у которых есть строгие требования к конфиденциальности данных, разработчики позволили вручную исключать отдельные модели из общего пула, чтобы данные точно не попадали к определенным поставщикам. Вторая версия, названная Fugu Ultra, настроена иначе: она жертвует скоростью ради максимального качества и глубины ответа на действительно сложные многошаговые задачи. По словам компании, первые пользователи чаще всего применяли именно эту версию для научных исследований, воспроизведения результатов научных статей, анализа кибербезопасности и работы с большими объемами специализированной литературы и патентов.

Насколько хорошо Fugu справляется с задачами

По собственным замерам компании, старшая версия продукта показывает результаты на уровне самых мощных на сегодняшний день закрытых моделей на серьезных тестах по инженерным, научным и логическим задачам. При этом стоит отметить важную деталь: сравнение проводилось с моделями, которые сами по себе публично недоступны, поэтому они не входят и в пул моделей, которыми управляет Fugu, а используются исключительно как ориентир для сравнения. Также нужно понимать, что все результаты соперников в этом сравнении компания взяла из открытых данных самих производителей этих моделей, а не перепроверила независимо. Так что к подобным цифрам стоит относиться как к заявлению самой компании, а не как к полностью независимому тесту.

Одним из наглядных примеров возможностей продукта стал эксперимент по автоматизации научных исследований. Системе поставили задачу самостоятельно улучшить процесс обучения небольшой языковой модели, и она в течение примерно 14 часов на одной-единственной видеокарте провела 123 отдельных эксперимента. При этом модель каждый раз меняла код обучения, проверяла результат, и затем сохраняла только те изменения, которые реально улучшали качество. По итогам эксперимента старшая версия продукта показала лучший средний результат, обойдя по этому же тесту анонимизированных конкурентов, за которыми скрывались известные модели других крупных компаний.

Заключение

Сегодня Sakana Fugu доступна через единый программный интерфейс, совместимый с популярным стандартом от OpenAI, а установить его в такие инструменты для разработчиков, как Codex или Claude Code, можно буквально одной командой. Компания предлагает как подписку для повседневного использования, так и оплату по факту использования для более крупных и требовательных задач. В планах на ближайшие месяцы разработчики обещают расширить пул моделей внутри системы за счет открытых моделей и собственных будущих разработок компании, а также дать пользователям больше возможностей контролировать то, как именно система принимает решения от их имени.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

ElevenLabs представила Studio 4.0 с генерацией видео, изображений и звука

ElevenLabs выпустила Studio 4.0 — обновлённый редактор, а также Studio Agent. В одном проекте теперь можно генерировать видео,...

Claude Code ушёл в облако: Anthropic открыла облачные сессии для всех и раздаёт до $250 на тест

24 сентября 2026 года Anthropic перевела облачные сессии Claude Code в общий доступ. Раньше функция работала в статусе...

Google выпустила Nano Banana 2 Lite — быструю модель для генерации изображений через Gemini API

Google выпустила Nano Banana 2 Lite (gemini-3.1-flash-lite-image) — новую модель для генерации и редактирования изображений. Это самая быстрая...

Kling AI выпустила Skill для генерации видео через ИИ-агентов

Kling AI запустила Kling Skills Suite — инструмент, который подключается к сторонним AI-агентам и даёт им доступ к...

OpenAI выпустила GPT-6 Sol и Luna и вдвое снизила цены

OpenAI выпустила GPT-6 Sol и GPT-6 Luna, среднюю и младшую модели поколения GPT-6. Они построены на наработках флагманской...

Промты для фото и открыток ко Дню России, +нейросети для генерации

Ищете промты для открыток ко Дню России? Нейросети могут сделать семейное поздравление по фото, портрет в праздничном образе,...

Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

Alibaba выпустила Qwen-Image-3.0 - третье поколение генератора изображений с прицелом на практическую пользу: длинные детальные подписи, читаемый мелкий...

Выход CapCut Video Studio и интеграция Dreamina Seedance 2.0 в CapCut

CapCut представила Video Studio - новый ИИ-режим создания роликов внутри веб-версии сервиса. Продукт важен не только как очередная...

OpenAI уберёт GPT-5.5 из ChatGPT и Codex 14 октября

OpenAI предупредила о завершении поддержки GPT-5.5 в ChatGPT, ChatGPT Work и Codex. Модель уберут из этих продуктов 14...

DeepSeek API: как получить ключ, как пользоваться бесплатно, как оплатить из России

DeepSeek API – это облачный сервис, который позволяет подключать ИИ-модели к внешним проектам. С его помощью можно интегрировать...

OpenAI выпустила ChatGPT Images 2.5 — генерация стала быстрее, а изображения можно точечно доработать

OpenAI выпустила ChatGPT Images 2.5 — обновлённую модель для генерации и редактирования изображений в ChatGPT. Компания заявляет, что...

Проверка текста нейросетью: частые ошибки новичков

Люди приходят к нейросети с текстом так же, как раньше несли его редактору: «вот, посмотри, всё ли нормально»....

Anthropic выпустила Claude Opus 5.5 — модель стала быстрее и дешевле 

Anthropic выпустила Claude Opus 5.5 для Claude, Claude Code и Claude Platform. Новая модель генерирует ответы более чем...

ElevenLabs открыла общий доступ к Eleven v3 Conversational

ElevenLabs открыла общий доступ к Eleven v3 Conversational — модели синтеза речи для диалогов в реальном времени. Она...

Kling запустила IMAGE O1 — новую ИИ-модель для генерации и редактирования изображений

Kling представила «IMAGE O1» — это обновлённая модель для генерации и редактирования изображений. Она работает и с текстом,...

Krea открыла API для Krea 2 с переносом стиля и мудбордами

Krea открыла API для Krea 2 - своей первой базовой модели генерации изображений, обученной с нуля. Анонс опубликован...

Будущий дата-центр Amazon в Техасе может стать главным источником углеродных выбросов в США

В рамках проекта дата-центра в округе Пекос, штат Техас, Amazon инвестирует в расположенную на площадке электростанцию, которая может...

Kling представила Avatar 2.0 — длина видео до 5 минут, «чистый» липсинк и «живая» мимика 

Разработчики Kling AI (Kuaishou) выпустили модель Avatar 2.0 — обновление инструмента для создания говорящих цифровых аватаров. Релиз состоялся...

Krea AI представила Krea 2 – собственную модель для генерации изображений

Krea AI 12 мая 2026 года анонсировала Krea 2 — новую модель для генерации изображений. В ветке компания...

От Google Translate к Gemini. Новая модель приближает синхронный перевод к живому диалогу

Двадцать лет назад Google Translate был всего лишь одним из первых машинных экспериментов с языком. Сначала он переводил...