- Sakana AIが2026年9月11日、「Fugu Max」と「Fugu Ultra v2」の2モデルを同時公開
- Fugu Maxは出力100万トークン6ドル(約900円)。Sonnet 5やGPT-5.6 Terraより40〜60%安い
- Fugu Ultra v2は8つのベンチマーク中5つで首位または同率首位
- 連携先からGPT-6 Astra・Claude Fable 5/5.1を意図的に外し、「単一モデル依存」からの脱却を証明
- ベンチマークはすべてSakana AI自社報告。第三者検証はまだない
「一番賢いAIを使いたい。でもGPT-6 AstraもClaude Fable 5.1も高すぎる」と悩んでいませんか?東京発のSakana AIが2026年9月11日に出した答えが、2つの新モデル「Fugu Max」と「Fugu Ultra v2」です。この記事では、料金・性能・連携先の変化から、日本企業がどう使えるかまでを整理します。
Fugu MaxとFugu Ultra v2とは?2つの新モデルの正体
まず前提から。Sakana Fugu(フグ)は「1つのAIモデル」ではありません。
Fuguの正体は、複数のAIモデルを裏で指揮するオーケストレーター(指揮役のAI)です。質問が来ると、その難しさを見きわめて、最適なAIに仕事を振り分けます。必要なら複数のAIに「考える役」「作る役」「チェックする役」を分担させ、1つの答えにまとめます。
今回発表されたのは、この指揮役の新バージョン2つです。
- Fugu Max:1ドルあたりの成果を最大化する「コスパ型」
- Fugu Ultra v2:難しい多段階タスクでの性能を最大化する「実力型」
両者は同じ指揮の仕組みを使っています。違うのは「何を目標に最適化したか」だけです。
どちらも9月11日からOpenAI互換API(ChatGPTと同じ書き方で呼び出せるAPI)で利用できます。既存ユーザーは、コードのモデル名を1行書き換えるだけで移行できます。
Fugu Max:出力料金40〜60%減の「コスパ型」
料金は入力2ドル・出力6ドル
Fugu Maxの料金は100万トークン(AIが読み書きする文字量の単位)あたり、入力2ドル(約300円)・出力6ドル(約900円)です。キャッシュ入力は0.25ドルです。
Sakana AIによると、出力価格はClaude Sonnet 5、GPT-5.6 Terra、Kimi K3と比べて40〜60%安いとのことです。
安いのに性能は落ちない?
安さだけなら小さなモデルを使えばいい話です。Fugu Maxの売りは、安さと性能の両立です。
公式発表では、Terminal Bench 2.1(ターミナル操作)、GPQA Diamond(大学院レベルの科学問題)、AA-LCR(長文読解)などで最高スコアを記録したとされています。10のベンチマーク中7つで「費用対効果の最前線」を更新した、というのがSakana AIの主張です。
仕組みはシンプルです。簡単な質問は安いモデルに、難しい質問だけ高いモデルに回す。優秀な受付係が、案件の重さを見て担当者を振り分けるイメージです。
新たにNVIDIAの「Nemotron」ファミリーなど、オープンウェイト(重みが公開された)モデルが連携先に加わったことも、コスト削減に効いています。
Fugu Ultra v2:8ベンチマーク中5つで首位の「実力型」
グラフ読解でOpus 5の約1.8倍
Fugu Ultra v2の目玉は、8つのベンチマーク中5つで首位または同率首位という成績です。7つでトップ2に入っています。
とくに目立つのが2つの数字です。
- Chartography(グラフや図の読み取り):48.3点。Claude Opus 5は27.3点、Claude Fable 5は29.5点
- DeepSWE(ソフトウェア開発):74.3点。トークン単価が3〜5倍のモデルを上回ったとされる
ほかにGDP.pdf(PDF資料の読解)、SWEFish、Toolathon(ツール利用)でも首位または同率首位です。
料金は入力5ドル・出力30ドル
ITmediaの報道によると、Fugu Ultra v2の料金は100万トークンあたり入力5ドル(約750円)・出力30ドル(約4,500円)、キャッシュ入力0.5ドルです。
これは前世代のFugu Ultra v1.1と同じ水準です。つまり「値段そのまま、性能アップ」の更新になります。ただし272,000トークンを超える長い入力では料金が上がる仕組みは従来通りです。
なぜGPT-6 AstraとFable 5.1を外したのか
「最強モデルなし」で最強を証明する狙い
今回の発表で一番注目すべきは、ベンチマークの数字ではありません。連携先モデルの中身です。
公式発表の注記には、こう書かれています。「Claude Fable 5、Fable 5.1、GPT-6 AstraはFugu Ultra v2のモデルプールに含まれていない」。学習データの締め切りは2026年8月28日です。
つまりFugu Ultra v2は、今もっとも高性能とされる2社のフラッグシップを使わずに、それらを上回るスコアを出したと主張しているのです。
これまでFuguには「結局は高いモデルを雇っているだけでは?」という批判がありました。Sakana AIは、あえてその2社を外すことで、指揮の仕組み自体に価値があると示そうとしています。
背景にある「6月の停止事件」
この判断には伏線があります。2026年6月、公開3日目のClaude Fable 5が米政府の輸出管理指令で全面停止し、約18日間使えなくなる事件が起きました(当サイトの解説記事)。
特定の1社のモデルに頼ると、その会社の都合や政府の規制で、ある日突然サービスが止まるリスクがあります。連携先を分散させることは、Sakana AI自身と、そのユーザーを守るための保険でもあるのです。
競合との比較:HydraFusion・OpenRouter・単体モデル
「複数のAIを自動で使い分ける」サービスは、2026年に入って急増しています。主なものを比べてみましょう。
| サービス | 提供元 | 特徴 | 料金の目安 |
|---|---|---|---|
| Fugu Max / Ultra v2 | Sakana AI(日本) | 学習済み指揮役が複数AIを分担・検証させる。OpenAI互換API | Max:入力2ドル/出力6ドル Ultra v2:入力5ドル/出力30ドル |
| Project HydraFusion | GitHub(米国) | Copilot内でSingle・Cascade・Critiqueの3パターンを切替。9月4日に研究プレビュー | Copilot料金に含む。Opus 5比でコスト67%減と主張 |
| OpenRouter Fusion | OpenRouter(米国) | 多数のモデルを1つのAPIで呼べるルーティング基盤 | 従量課金(モデルごと) |
| 単体フラッグシップ | OpenAI / Anthropic | GPT-6 Astra、Claude Fable 5.1など。1社完結で管理が単純 | Fuguの3〜5倍のトークン単価(Sakana AI主張) |
Fuguの強みは、指揮役そのものを強化学習で鍛えている点です。ICLR 2026に採択された「TRINITY」「The Conductor」という研究が土台になっています。単なるルーター(振り分け装置)ではなく、複数のAIに議論や検証をさせて答えの質を上げます。
一方、HydraFusionはコーディングに特化しており、GitHub Copilotの外では使えません。汎用APIとして使えるかどうかが、Fuguとの大きな違いです。
日本企業への影響と3つの使いどころ
Sakana AIは東京のAIユニコーンです。日本語対応はもちろん、日本語特化モデル「Namazu」も展開しています。国内企業にとって、Fuguはどう役立つのでしょうか。
シーン1:カスタマーサポートの自動応答
あるECサイトのサポート部門を想像してください。1日3,000件の問い合わせのうち、8割は「配送はいつ?」「返品方法は?」といった定型質問です。
Fugu Maxなら、この8割を安いモデルで処理し、残り2割の複雑なクレームだけ高性能モデルに回します。担当者が振り分けルールを書く必要はありません。出力単価が6ドルなので、月間コストは従来の半分近くに抑えられる計算です。
シーン2:決算資料やグラフの読み取り
経理担当者が、取引先20社の決算PDFから売上推移のグラフを読み取り、比較表を作る作業を考えてみましょう。
Fugu Ultra v2はChartography(グラフ読解)で48.3点と、Opus 5の27.3点を大きく上回っています。GDP.pdf(PDF読解)でも首位です。図表の多い日本のIR資料や行政文書を扱う業務と相性がよさそうです。
シーン3:社内システムの開発支援
情シス3人の中堅メーカーが、社内の在庫管理ツールを改修するケースです。DeepSWEで74.3点を出したFugu Ultra v2に、仕様の整理からコード生成、テストまで任せられます。
OpenAI互換APIなので、すでにGPT系のAPIで作ったツールがあれば、接続先とモデル名を書き換えるだけで試せます。
サブスクでも使える
API以外に、月20ドルのStandard、月100ドルのPro、月200ドルのMaxという3段階のサブスクリプションもあります。まず個人で試したい人は、月20ドルから始められます。
導入前に知っておきたい4つの注意点
魅力的な発表ですが、うのみにする前に押さえておきたい点があります。
1. ベンチマークはすべて自社報告です。第三者機関による独立した検証はまだ発表されていません。Sakana AIは7月、サイバー防御AI「Fugu-Cyber」で86.9%と主張したスコアが、ベンチマーク作成者の実測では約20%だった前例があります。
2. どのモデルに振り分けたかは見えません。Sakana AIは「ルーティング情報は設計上公開しない」としています。監査が必要な業務では、この不透明さが問題になる可能性があります。
3. 応答時間が読めません。難しいタスクでは、複数のAIが議論するため、30分近くかかった例も報告されています。リアルタイム性が必要な用途には向きません。
4. EU・EEAではまだ使えません。GDPR(EUの個人情報保護規則)対応が進行中です。欧州拠点のある企業は注意が必要です。
よくある質問(FAQ)
Q1. Fugu MaxとFugu Ultra v2、どちらを選べばいい?
大量の問い合わせ処理や、簡単なタスクが多い本番システムならFugu Maxです。自律的な調査、フルスタック開発、グラフ分析など、難しい仕事を確実にこなしたいならFugu Ultra v2です。
Q2. 既存のFugu Ultra v1.1からの移行は面倒?
面倒ではありません。OpenAI互換APIのモデル名を1行書き換えるだけです。料金もUltra v1.1と同じ水準なので、追加コストなしで性能アップを受けられます。
Q3. GPT-6 AstraやClaude Fable 5.1を使いたいときは?
Fugu Ultra v2の連携先には含まれていません。それらのモデルを直接使いたい場合は、各社のAPIを別途契約する必要があります。
Q4. 日本語での性能はどうですか?
今回の発表で公開されたベンチマークは英語中心です。日本語特化の数値は示されていません。日本語重視なら、同社の「Namazu」との併用も選択肢です。
Q5. 自社サーバーで動かせますか?
できません。オープンウェイト版は提供されておらず、Sakana AIのAPI経由でのみ利用できます。データを外部に出せない業務には向きません。
まとめ
- Sakana AIが9月11日、コスパ型「Fugu Max」と実力型「Fugu Ultra v2」を公開
- Fugu Maxは出力6ドル(約900円)で、Sonnet 5などより40〜60%安い
- Fugu Ultra v2は8ベンチマーク中5つで首位。グラフ読解はOpus 5の約1.8倍
- GPT-6 AstraとClaude Fable 5/5.1を連携先から外し、単一モデル依存からの脱却を狙う
- 数字は自社報告のみ。振り分けの不透明さ・応答時間・EU非対応が課題
まずは月20ドルのStandardプランか、API経由で自社の実データを1週間ほど流し、応答時間と品質を自分の目で確かめてみてください。
参考文献
- Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier – Sakana AI
- Sakana AIが「Fugu Ultra v2」「Fugu Max」を発表 – ITmedia AI+
- Sakana AI Launches Fugu Max and Fugu Ultra v2 – MarkTechPost
- Sakana Fugu Ultra v2: a smaller pool, a higher score – OrcaRouter
- Sakana AI Splits Fugu Into Max and Ultra v2 to Cut Costs 60% – AlphaSignal
