На этой неделе токийский стартап Sakana AI выпустил Sakana Fugu и его флагманскую версию Fugu Ultra. Это мультиагентный оркестратор, работающий как обычная модель через единый OpenAI-совместимый API. Это событие является продолжением пяти параллельных трендов в развитии ИИ.
Япония выходит в мировые лидеры и делает это своим способом
Sakana AI основана двумя бывшими исследователями Google: Льоном Джонсом, один из восьми соавторов «Attention Is All You Need» — статьи, давшей миру архитектуру Transformer, и Дэвидом Ха. Лаборатория базируется в Токио, специализируется на эволюционных алгоритмах и коллективном интеллекте.
Япония не пытается догнать США в гонке масштабов и не строит, например, какой-нибудь ЦОД на 220 000 GPU. Вместо этого японский путь оказался изобретательным: не тренировать ещё более крупную модель, а обучить маленькую модель управлять чужими крупными.
Параллельно правительство Японии 22 июня опубликовало обновлённый Базовый план по ИИ с фокусом на кибер-риски и дипфейки. Регуляторная и коммерческая стратегии движутся синхронно, например, в отличие от ЕС.
Экспортный контроль становится центральной
Sakana прямо называет повод для выпуска своего сервиса:
«Anthropic приостановила Fable 5 и Mythos по приказу правительства США — это не абстрактный риск, если ваш банк, министерство или завод построили workflow вокруг одной модели».
Это первый в истории случай, когда frontier-продукт позиционируется через защиту от суверенного риска как центральный элемент.
Этот вопрос становится новой нормой: входит ли «доступность модели для пользователей с любым гражданством» в SLA-контракт? Sakana не единственная идет этим путем: Kimi K2.7, GLM-5.2, MiniMax M3 — все позиционируются через MIT лицензию, развёртываемую где угодно. Таким образом, сформировалась новая маркетинговая категория «инфраструктура ИИ-суверенитета».
Наука как фундамент нового продукта
Fugu в отличие от решения OpenRouter — это не «несколько API-запросов в пайплайне». Это обученная политика координации, описанная в двух статьях Sakana, представленных на ICLR 2026.
➡️ Trinity: маленький самообучаемый координатор, который управляет пулом LLM. Это эволюционный подход, координатор «совершенствуется» в управлении командой.
➡️ Conductor: метод обучения coordinator-модели через RL на естественном языке. Здесь координатор учится не «правилам», а гибкому поведению.
Архитектура Fugu представляет собой одну координирующую LLM на 7 млрд параметров, которая обучена решать, когда, какую модель из пула, для чего и сколько раз вызвать, включая рекурсивный вызов себя. Разница между Fugu и обычным оркестратором — как между обученной собакой-поводырём и GPS-маршрутом.
Frontier-модели — это дорого. Оркестратор может быть дешевле, но не всегда
Fugu Ultra: $5 input / $30 output за миллион токенов. Подписки: $20 / $100 / $200 в месяц. Выглядит дешевле, чем Fable 5 "при жизни" ($10/$50).
НО $5/$30 — это цена запроса к координатору. Реальная стоимость = Fugu + стоимость всех вызовов к GPT-5.5, Opus 4.8 и Gemini «под капотом», которая пользователю не раскрывается. Аналогия тут такая: умный роутер может сэкономить деньги, выбирая правильную модель, но может и скрыть дорогую цепочку вызовов за одним аккуратным ответом.
Подтверждение тренда после OpenRouter Fusion
За одну неделю случилось четыре события про одну идею:
1️⃣ OpenRouter Fusion: ансамбль моделей с судьёй-синтезатором.
2️⃣ Cursor Origin: GitHub-инфраструктура для агентных workflow.
3️⃣ OpenAI Record & Replay: превращение действий пользователя в скиллы агента.
4️⃣ Sakana Fugu: обученный координатор для пула frontier-моделей.
Все четыре — об одной концепции. Выигрывает не одна модель, а система, которая умеет выбирать, спорить и собирать ответ.
Экономический смысл прост: если frontier-качество достигается через оркестрацию, то гонка «ещё более мощная одиночная модель» теряет смысл — за исключением задач, требующих внутренней согласованности длинных рассуждений.
💬 Тест Тьюринга. События в сфере ИИ. Подписаться
