• Виктор
  • Блог
  • 2 мин. чтения

Sakana Fugu: ИИ, который учится управлять другими ИИ


22 июня 2026 года японская лаборатория Sakana AI (Токио) представила свой новый коммерческий продукт под названием Sakana Fugu. Компанию основали Дэвид Ха, бывший директор по исследованиям в Google Brain и Ллион Джонс, один из авторов знаменитой научной статьи. Эта статья известна тем, что когда-то именно она положила начало архитектуре трансформеров, лежащей в основе почти всех современных языковых моделей. С самого начала своей работы эта команда придерживалась не совсем обычной для отрасли идеи: вместо того, чтобы бесконечно наращивать размер одной гигантской модели, лучше научить несколько разных моделей грамотно работать вместе. То есть, создать некий ансамбль, работающий подобно стае рыб или колонии муравьев, которые в природе решают слишком сложные для отдельного существа задачи выживания. Именно из этой философии и родился новый продукт, о котором мы и поговорим вместе с командой проекта Креатор Проджект.

Из чего на самом деле состоит нейросеть

По сути, Sakana Fugu представляет собой не отдельную большую нейросеть в привычном понимании этого слова. По большей части это собранные вместе уже существующие передовые модели других компаний. Однако при этом пользователь обращается к системе точно так же, как обратился бы к любой обычной языковой модели. Он отправляет запрос через единый программный интерфейс, а внутри система сама решает, как лучше справиться с задачей. К примеру, она может ответить напрямую, если задача простая. А может собрать целую команду из нескольких разных моделей и координировать их совместную работу, если задача сложная и многоступенчатая. Все эти внутренние сложности остаются полностью скрытыми от пользователя. Внешне процесс по-прежнему выглядит как обращение к одной-единственной модели.

Как Fugu координирует другие модели

Технически сама Sakana Fugu тоже является языковой моделью, только устроена она иначе, чем привычные большие модели. Ее специально обучили решать, когда стоит делегировать часть задачи другим моделям, как эти модели должны обмениваться информацией между собой и как затем объединить их отдельные результаты в один связный и надежный ответ. Интересная деталь заключается в том, что в процессе такой координации Fugu может вызывать даже саму себя, что позволяет ей тратить больше времени и вычислительных ресурсов на особенно сложные части задачи. Данная идея опирается на два научных исследования компании, представленные в этом году на крупной международной конференции по машинному обучению.

При запуске компания предложила пользователям на выбор две версии продукта. Обычная версия под названием Fugu старается найти баланс между качеством ответов и скоростью работы. Поэтому она хорошо подходит для повседневных задач вроде написания и проверки программного кода или общения с чат-ботом. Тем командам, у которых есть строгие требования к конфиденциальности данных, разработчики позволили вручную исключать отдельные модели из общего пула, чтобы данные точно не попадали к определенным поставщикам. Вторая версия, названная Fugu Ultra, настроена иначе: она жертвует скоростью ради максимального качества и глубины ответа на действительно сложные многошаговые задачи. По словам компании, первые пользователи чаще всего применяли именно эту версию для научных исследований, воспроизведения результатов научных статей, анализа кибербезопасности и работы с большими объемами специализированной литературы и патентов.

Насколько хорошо Fugu справляется с задачами

По собственным замерам компании, старшая версия продукта показывает результаты на уровне самых мощных на сегодняшний день закрытых моделей на серьезных тестах по инженерным, научным и логическим задачам. При этом стоит отметить важную деталь: сравнение проводилось с моделями, которые сами по себе публично недоступны, поэтому они не входят и в пул моделей, которыми управляет Fugu, а используются исключительно как ориентир для сравнения. Также нужно понимать, что все результаты соперников в этом сравнении компания взяла из открытых данных самих производителей этих моделей, а не перепроверила независимо. Так что к подобным цифрам стоит относиться как к заявлению самой компании, а не как к полностью независимому тесту.

Одним из наглядных примеров возможностей продукта стал эксперимент по автоматизации научных исследований. Системе поставили задачу самостоятельно улучшить процесс обучения небольшой языковой модели, и она в течение примерно 14 часов на одной-единственной видеокарте провела 123 отдельных эксперимента. При этом модель каждый раз меняла код обучения, проверяла результат, и затем сохраняла только те изменения, которые реально улучшали качество. По итогам эксперимента старшая версия продукта показала лучший средний результат, обойдя по этому же тесту анонимизированных конкурентов, за которыми скрывались известные модели других крупных компаний.

Заключение

Сегодня Sakana Fugu доступна через единый программный интерфейс, совместимый с популярным стандартом от OpenAI, а установить его в такие инструменты для разработчиков, как Codex или Claude Code, можно буквально одной командой. Компания предлагает как подписку для повседневного использования, так и оплату по факту использования для более крупных и требовательных задач. В планах на ближайшие месяцы разработчики обещают расширить пул моделей внутри системы за счет открытых моделей и собственных будущих разработок компании, а также дать пользователям больше возможностей контролировать то, как именно система принимает решения от их имени.



Источник

Где попробовать
Claude, GPT, Gemini и ещё 300 моделей — в одном окне
Умка даёт доступ к нейросетям на русском и за рубли: без VPN и зарубежных карт. Текст, картинки, видео и музыка — в одном интерфейсе. На пробу 60 токенов, карта не нужна.
Открыть Умку бесплатно
Межтекстовые Отзывы
Посмотреть все комментарии
guest

OpenAI снова столкнулась с неконтролируемым поведением ИИ-агентов

OpenAI оказалась в центре ещё одного инцидента с роем ИИ-агентов. По словам исследователей, внутренние агенты компании в мае...

Вышла Kling Video 3.0 — ИИ-модель для генерации видео из нескольких сцен

Kuaishou выпустила Kling Video 3.0 — новую версию своей модели для генерации видео. Ключевое изменение — теперь ролик...

Лимиты использования в ChatGPT/Codex: где посмотреть и как сбросить

Даже на платных тарифах ChatGPT действуют лимиты на использование. Если они заканчиваются, сервис может прямо во время работы...

DeepSeek представила DeepSeek-OCR — новую модель для сжатия визуального контекста в LLM

Компания DeepSeek показала DeepSeek-OCR — OCR-модель, созданную специально для больших языковых моделей. Вместо обычного распознавания текста она сжимает...

Synthesia встроила агента в редактор и обновила модель аватаров

Synthesia запустила Assistant - чат-агента, который собирает ролик из промпта, документа или ссылки прямо в редакторе и правит...

«Ёбидоёби» запустила коллаборацию с Atomic Heart

Служба доставки «Ёбидоёби» запустила коллаборацию с Atomic Heart. В меню появился одноимённый набор из 40 роллов в лимитированной...

Нейросеть для сложных расчётов: чек-лист для новичка

Недавно нейросеть Claude посчитала физическую задачу, с которой годами возились специалисты — расчёт на девять петель в квантовой...

Runway выпустила Aleph 2.0: точечное ИИ-редактирование видео по одному кадру

Американская компания Runway представила Aleph 2.0 - крупное обновление своей ИИ-модели для точечного изменения видеоматериалов. Инструмент, встроенный в...

Промты для коллажей — как сделать коллаж по фото с помощью ИИ

Хотите красивые фоточки для соцсетей, но без одинаковых селфи? Держите 5 промтов для трендовых коллажей: неон ночью, дождь...

DeepSeek выпустила V4.1 Flash — открытую ИИ-модель с контекстом до 1 млн токенов

DeepSeek выпустила DeepSeek V4.1 Flash и открыла веса модели на Hugging Face. Она принимает текст и изображения, отвечает...

ElevenLabs выпустили Eleven v4 и v4 Turbo — ИИ для озвучки с управлением эмоциями и манерой речи

ElevenLabs представила новые модели синтеза речи Eleven v4 и Eleven v4 Turbo. Они построены на новой архитектуре и...

Google анонсировала Pics — ИИ-редактор для работы с изображениями

Google анонсировала Pics — новый инструмент для генерации и редактирования изображений в Google Workspace. Он работает на базе...

Gemini 3.8 Live получила видеоаватар для бизнеса

Google выпустила Gemini 3.8 Live with Live Avatar, режим с почти синхронным видеоаватаром для разговорных моделей. Функция доступна...

ImagineArt запустила Ads Studio для генерации UGC-рекламы из ссылки на продукт

ImagineArt запустила Ads Studio - инструмент для генерации рекламных роликов из ссылки на товар. Сервис собирает UGC-видео, ролики...

ElevenLabs выпустила Music v2.5 с улучшенным звуком и точным следованием запросу

ElevenLabs представила Music v2.5 — новую версию модели для генерации музыки. Она создаёт более многослойные композиции, точнее следует...

Промты для новогодней ИИ-фотосессии, +подходящие нейросети

Как говорят, готовь сани зимой, а промты для новогодних ИИ-фотосессий — в ноябре. Картинки можно публиковать уже сейчас...

Kling 4.0 выйдет в октябре, а Flash уже доступна подписчикам Ultra

Kling AI анонсировала видеомодель Kling 4.0 с выходом в октябре, а облегчённая Kling 4.0 Flash уже работает у...

Pika запустила Relight Media для изменения света в фото и видео

Pika открыла Relight Media — приложение, которое меняет освещение в готовом фото или видеоролике. Пользователь загружает файл, выбирает...

Runway представила Multi-Shot App: от одного промпта к полноценной многосценной истории с диалогами, звуком и монтажом

Runway представила новый инструмент, который заметно упрощает создание видеоконтента с помощью нейросетей. Multi-Shot App превращает один текстовый запрос...

Anthropic выпустила Claude Opus 5.5 — модель стала быстрее и дешевле 

Anthropic выпустила Claude Opus 5.5 для Claude, Claude Code и Claude Platform. Новая модель генерирует ответы более чем...