サカナAIは9月11日、オーケストレーション基盤Sakana Fuguの新版として、費用効率を伸ばすFugu Maxと、ピーク性能を伸ばすFugu Ultra v2を同時公開した。どちらもOpenAI互換APIで提供され、既存のFugu利用ならモデル指定を一行変えるだけで切り替えられる。
Fugu Maxは、NVIDIA Nemotronを含むオープンおよび専門モデルの大規模なプールへ動的に振り分ける。入力100万トークンあたり2ドル、出力6ドルで、出力単価はSonnet 5、GPT 5.6 Terra、Kimi K3より40〜60%安いとする。Terminal Bench 2.1、GPQAD、AA-LCR、GDP.pdf、AutomationBench、社内のSWEFishを含む6指標で総合首位、10指標中7つで費用対効果のパレートフロンティアを広げたと報告した。
Fugu Ultra v2は品質優先の旗艦だ。視覚と構造化データを扱うChartographyは48.3で、Opus 5の27.3、Fable 5の29.5を上回る。実世界のソフトウェア工学指標DeepSWEは74.3で、トークン単価が3〜5倍高いモデルを超えたとする。8指標中5つで首位または同率首位、7つで上位2位以内。学習カットオフは20260828で、Fable 5、Fable 5.1、GPT-6 Astraはエージェントプールに含まれない。
実務への影響
最上位の閉域モデルを常時呼ぶ前提から、用途に応じてMaxとUltraを振り分ける設計へ移せる。供給途絶やAPI廃止への耐性を謳う一方、ベンチマークはベンダー発表なので、自社のエージェント負荷でレイテンシと品質を測ってから採用を決めるべきだ。