Sakana AI обновила маршрутизатор моделей Fugu Ultra: что даёт v1.1 и стоит ли доверять цифрам
Sakana AI выпустила Fugu Ultra v1.1 с приростом до 7,9 баллов и заявленным превосходством над Fable 5. Разбираем результаты, цены, доступность и подводные камни без независимых тестов.
Sakana AI выпустила обновление Fugu Ultra v1.1 - системы, которая автоматически подбирает лучшую AI-модель под конкретный запрос. Компания заявляет о приросте производительности до 7,9 баллов и превосходстве над флагманской моделью Fable 5 от Anthropic. Прямо сейчас все эти цифры - результат внутреннего тестирования самой Sakana AI. Независимых проверок нет.
Первая версия Fugu запомнилась громкими обещаниями, но на практике пользователи столкнулись с медленной работой и высоким расходом токенов. Обновление позиционируется как работа над ошибками. Разберёмся, что изменилось, кому это может быть полезно и почему с выводами лучше не торопиться.
Что такое Fugu Ultra и зачем нужно обновление
Fugu Ultra - это маршрутизатор AI-моделей. Представьте, что вам нужно решить задачу, но вы не знаете, какой инструмент подойдёт лучше. Вместо того чтобы перебирать варианты вручную, вы отдаёте запрос системе, а она сама направляет его той модели, которая справится оптимально. Это экономит время и, по задумке, повышает качество ответа.
В пуле Fugu находятся несколько языковых моделей. Система анализирует запрос и выбирает подходящую. Если ни одна не даёт уверенного результата, Fugu может скомбинировать ответы от разных моделей. Такой подход напоминает консилиум специалистов: каждый высказывает мнение, а координатор собирает итоговое решение.
Первая версия продукта появилась несколько месяцев назад. Отзывы оказались сдержанными. Пользователи отмечали, что маршрутизация действительно иногда улучшает ответы, но плата за это - заметная задержка перед выдачей и перерасход токенов. Для бизнеса, где важны скорость и предсказуемый бюджет, такие компромиссы неприемлемы. Fugu Ultra v1.1 - попытка Sakana AI исправить ситуацию и доказать, что концепция работает.
Главные цифры обновления: прирост 7,9 баллов и сравнение с Fable 5
Ключевая метрика, которую приводит Sakana AI, - прирост производительности до 7,9 баллов по сравнению с предыдущей версией Fugu Ultra. Компания использует собственную шкалу оценки, детали методологии не раскрываются. На практике это означает, что ответы стали точнее, логичнее и полезнее - по крайней мере, если верить внутренним замерам.
Второй громкий тезис: Fugu Ultra v1.1 обходит модель Fable 5 от Anthropic. Fable 5 - это флагманская модель конкурента, которая показывает высокие результаты в сложных рассуждениях и программировании. Мы подробно разбирали её возможности в обзоре Claude Opus 5, где сравнивали производительность и стоимость разных решений Anthropic. Теперь Sakana AI утверждает, что их маршрутизатор превосходит топовую модель, даже не имея к ней доступа. Звучит интригующе.
Как Fugu обходит Fable 5, не используя её
Механизм проще, чем кажется. Fugu не пытается воспроизвести Fable 5. Вместо этого маршрутизатор комбинирует ответы нескольких моделей из своего пула. Представьте команду из трёх сильных, но не рекордных специалистов. Каждый предлагает решение, а координатор выбирает лучшие части и собирает итоговый ответ. В сумме такая комбинация может превзойти одного гения.
Это похоже на принцип, который Anthropic сама использует в Claude Code для код-ревью - мы рассказывали об этом в материале про мультиагентную проверку кода. Несколько специализированных агентов ищут ошибки независимо, а затем результаты объединяются. Качество итоговой проверки выше, чем у одного даже очень сильного ревьюера.
Sakana AI использует похожую логику, но применяет её не к поиску багов, а к генерации ответов на любые запросы. Технически это работает через оценку уверенности: если первая модель отвечает неуверенно, подключается вторая, затем третья. Итоговый ответ собирается из фрагментов с наивысшей оценкой достоверности.
Почему к результатам стоит отнестись с осторожностью
Все цифры, которые мы обсуждаем, получены в ходе внутреннего тестирования Sakana AI. Компания не предоставила данные для независимого аудита. Методология оценки не опубликована. Бенчмарки, если они и использовались, не названы.
Это не первый случай, когда разработчик маршрутизатора делает громкие заявления. Первая версия Fugu тоже сопровождалась впечатляющими цифрами. Пользователи, которые начали тестировать продукт, быстро обнаружили расхождение между обещаниями и реальностью. Медленная генерация ответов и перерасход токенов стали главными претензиями. Пока Sakana AI не показала данные о скорости работы и эффективности расхода токенов в версии 1.1, есть риск повторения истории.
Отдельный вопрос - сравнение с Fable 5. Anthropic регулярно публикует результаты своих моделей на независимых бенчмарках. Fugu Ultra v1.1 такими данными похвастаться не может. Мы не знаем, по каким критериям проводилось сравнение и насколько оно объективно. В мире AI-моделей такая ситуация - красный флаг. Без внешней верификации любые заявления о превосходстве остаются маркетингом.
Похожая история недавно разворачивалась вокруг GPT-5.6 и других крупных релизов - мы собирали ключевые события в дайджесте недели. Тогда тоже потребовалось время, чтобы независимые исследователи проверили заявленные результаты.
Цены, доступность и новые интеграции
Стоимость Fugu Ultra v1.1 не изменилась: 5 долларов за миллион входных токенов и 30 долларов за миллион выходных. Это стандартный тариф для премиум-моделей. Для сравнения, Claude Fable 5 стоит 10 долларов за входные токены, а Opus 5 - 5 долларов. Разница в стоимости выходных токенов может быть существенной при интенсивном использовании.
Сервис по-прежнему недоступен пользователям из Европейского союза и Европейской экономической зоны. Причина - требования GDPR, европейского регламента о защите данных. Sakana AI не комментирует, планирует ли компания адаптировать продукт под эти нормы. Для европейских команд это означает необходимость искать альтернативы или использовать VPN, что создаёт дополнительные риски с точки зрения compliance.
Claude Code: запуск Fugu из терминала
Главное техническое новшество версии 1.1 - поддержка Claude Code. Разработчики теперь могут вызывать Fugu напрямую из командной строки, не переключаясь между сервисами. Это часть стратегии Sakana AI по привлечению технической аудитории.
Сценарий выглядит так: вы работаете в терминале, пишете код и в какой-то момент понимаете, что нужна помощь AI. Вместо того чтобы открывать браузер, копировать код и вставлять в веб-интерфейс, вы даёте команду прямо в терминале. Fugu принимает запрос, маршрутизирует его и возвращает ответ. Интеграция снижает трение и ускоряет рабочий процесс.
Для команд, которые уже используют Claude Code в повседневной работе, это интересное дополнение. Однако важно помнить: вы платите не только за токены Fugu, но и за сам вызов через Claude Code, если он тарифицируется отдельно. Перед внедрением в продакшен-пайплайн стоит внимательно посчитать совокупную стоимость.
Подводные камни: что осталось от первой версии
Главная проблема первой версии Fugu - высокий расход токенов. Маршрутизация требует нескольких обращений к моделям для одного запроса. Если система опрашивает три модели, вы платите за три генерации, а получаете один ответ. В некоторых сценариях это увеличивало затраты в разы по сравнению с использованием одной модели.
Вторая проблема - задержка. Пока маршрутизатор опрашивает модели, сравнивает ответы и собирает итоговый результат, проходят секунды. Для диалоговых интерфейсов это некритично. Для приложений, где важна скорость реакции, каждая секунда на счету.
Sakana AI не опубликовала данные о том, изменились ли эти показатели в версии 1.1. Мы не знаем, сократилось ли количество обращений к моделям на один запрос. Не знаем, уменьшилась ли задержка. Пока эти метрики скрыты, рекомендовать Fugu для задач с жёсткими требованиями по скорости и бюджету нельзя.
Стоит ли пробовать Fugu Ultra v1.1: рекомендации по ролям
Разработчикам: тестируйте, но считайте токены
Интеграция с Claude Code - весомый аргумент в пользу того, чтобы дать Fugu шанс. Возможность обращаться к маршрутизатору прямо из терминала ускоряет рабочий процесс. Начните с небольших задач: генерация документации, рефакторинг простых функций, поиск типовых ошибок. Мониторьте расход токенов через панель управления Sakana AI. Если затраты окажутся приемлемыми, постепенно расширяйте использование.
Параллельно сравните качество ответов с прямыми запросами к Claude Opus 5 или другим моделям. Только прямое A/B-тестирование на ваших задачах покажет, оправдывает ли прирост качества дополнительные расходы.
Руководителям: отложите решение до независимых обзоров
Внедрять Fugu в бизнес-процессы прямо сейчас рискованно. Нет подтверждённых данных о производительности. Нет ясности по совокупной стоимости владения. Нет информации о стабильности работы под нагрузкой. Дождитесь тестов от авторитетных изданий или независимых исследователей. Когда появятся объективные бенчмарки, можно будет принимать решение на основе цифр, а не маркетинговых заявлений.
Если ваша команда уже использует модели Anthropic, обратите внимание на Opus 5 - она даёт сопоставимое с Fable 5 качество при вдвое меньшей цене. Это проверенное решение с понятными метриками и предсказуемым поведением.
AI-энтузиастам Fugu Ultra v1.1 интересен как кейс. Идея маршрутизации моделей перспективна. Если Sakana AI удастся решить проблемы с производительностью и прозрачностью, продукт может занять свою нишу. Пока же это эксперимент, за который вы платите полную цену. Пробуйте, но не переплачивайте и не стройте на этом фундаментальных рабочих процессов.