最終確認:2026年8月4日
Claude Fable 5 —— 全モデル比較ハブ
全体像を一枚で把握:Claude Fable 5 を Anthropic 自社ラインアップと 2026 年の主要なライバルすべてと比較——価格、エージェント型コーディング、コンテキスト、オープン性、最適な用途。すべての数字に日付と出典を添え、各モデルの完全比較ページへのリンクも用意しました。
TL;DR —— Fable 5 を一言で
Claude Fable 5 は Anthropic が公表した中で最高のエージェント型コーディング性能を持つモデル——SWE-Bench Pro 80.3%、100万トークンあたり $10/$50——ですが、もはや Claude のデフォルトではありません。2026年7月24日以降、Claude Max のデフォルトモデルは Claude Opus 5 で、Fable 5 の能力帯を半額($5/$25)で提供し、強制データ保持もありません。最難関のエージェント作業——長時間の自律実行、フロンティア級コーディング、リポジトリ全体の 1M 分析——には Fable 5 を、それ以外には Opus 5(または安価なライバル)を選びましょう。下表で9つの代替案を一望できます。
最終確認日 — 2026-08-04
本ページの価格とベンチマークは、2026年8月4日に記載の出典と照合済みです。Anthropic の数字は src/lib/model-pricing.ts(Anthropic 価格ドキュメントと照合)に基づきます。競合の数字は当サイトの個別比較ページ(各ページに日付と出典)と後述のベンダーページに基づきます。確認できなかった数字は「not confirmed」と日付を付して表記しています。
マスター比較マトリクス
API 定価(100万トークンあたり、米ドル)と、ほとんどの選定を左右する要点。詳細と注記は以下および各比較ページにあります。
| モデル | 入力(100万あたり) | 出力(100万あたり) | コンテキスト | オープンウェイト | 最適な用途 | 出典 |
|---|---|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | 1M | Closed API | フロンティア級 agent コーディング | 公式(ベンダー文書) |
| Claude Opus 5 | $5.00 | $25.00 | 1M | Closed API | デフォルトライン・保持なし | 公式(ベンダー文書) |
| Claude Sonnet 5 | $2.00* | $10.00* | 1M | Closed API | バランス型 Claude ティア | 公式(ベンダー文書) |
| Gemini 3.1 Pro | $2.00 | $12.00 | 1M | Closed API | マルチモーダル・Google 連携 | 公式(ベンダー文書) |
| GPT-5.5 | $5.00 | $30.00 | 400K | Closed API | OpenAI エコシステム製品 | 公式(ベンダー文書) |
| GLM 5.2 | ~$1.40 | ~$4.40 | 1M | Open weights (MIT) | 無料ローカル・オープンウェイト | ベンダー自己申告 |
| DeepSeek V4 Pro | $0.435 | $0.87 | 1M | Open weights | 低価格・高推論 | ベンダー自己申告 |
| DeepSeek V4 Flash | $0.14 | $0.28 | 1M | Open weights (MIT) | 大量処理・コモディティ | ベンダー自己申告 |
| Qwen 3.8 Max | ≈$2.00 | ≈$6.00 | 1M | Announced, not released | 中国 + 価格 | ベンダー自己申告 |
| Kimi K3 | $3.00 | $15.00 | 1M | Open weights | 中国語 + オープンウェイト | ベンダー自己申告 |
Sonnet 5 の価格は 2026-08-31 までの導入価格です。Gemini 3.1 Pro の料金は 200K トークンまでのプロンプトに適用(超過分は上位レート)。GPT-5.5 の料金は 272K まで(超過は長文脈レート)、より安い非推論モード $1.25/$10 もあります。GLM 5.2・DeepSeek V4 Pro/Flash・Qwen 3.8 Max・Kimi K3 の価格はベンダー自己申告で独立検証はされていません。Qwen の $2/$6 は国際定価の推定値——詳細はベンチマーク表の下の注記を参照。「公式」= ベンダー文書、「ベンダー自己申告」= ベンダー発表で未検証です。
主要ベンチマークマトリクス —— 誰が測ったか
公表数字のあるモデルのエージェント型コーディングとナレッジワークのスコア。すべての数字に出典を明記しています。ラボ公表の数字は方向性の参考として扱ってください。
| モデル | Claude Fable 5 | Claude Opus 5 | GPT-5.5 | GLM 5.2 |
|---|---|---|---|---|
| SWE-Bench Pro(エージェント型コーディング) | 80.3% | Not confirmed(2026-08-04時点) | 58.6% | 62.1% |
| FrontierCode Diamond(高難度コーディング) | 29.3% | 公表スコアなし | 5.7% | 公表スコアなし |
| GDPval-AA(ナレッジワーク) | 1932 | 公表スコアなし | 1769 | 公表スコアなし |
| OSWorld-Verified(コンピューター操作) | 85.0% | 公表スコアなし | 78.7% | 公表スコアなし |
出典:Fable 5・Opus 5・Sonnet 5 は Anthropic の2026年6月9日ローンチ発表とモデルドキュメント(ベンダー自己申告、2026年8月4日に Anthropic ソースと照合)。GPT-5.5 は OpenAI の発表(ベンダー自己申告)。GLM 5.2 の SWE-Bench Pro 62.1% と FrontierSWE 74.4% は GLM 5.2 テクニカルレポート(2026年6月、ベンダー自己申告);同表の Opus 4.8 と GPT-5.5 の列は Anthropic / OpenAI の数字。Gemini 3.1 Pro・DeepSeek V4 Pro・DeepSeek V4 Flash・Qwen 3.8 Max・Kimi K3 は2026年8月4日時点で SWE-Bench Pro の公表スコアがありません——推測せずその旨を明記しています。
エビデンスのパリティ:Fable 5 の 80.3% と GPT-5.5 の 58.6% は、同じハーネス定義とスコアリングプロトコルを共有する唯一の SWE-Bench Pro 数字ペアです(各ラボが設定を選択した上で)。GLM 5.2 の 62.1% は異なるハーネス実装に基づき、直接比較はできません。GDPval-AA 1932(Fable 5)と 1769(GPT-5.5)は Artificial Analysis の計測(独立)。2026-08-04時点で、Fable 5 以外に独立検証済みの SWE-Bench Pro スコアを持つモデルはありません。Fable 5 の全ベンチマークはベンチマーク解説ページを参照。
選定ガイド —— 予算別
価格上限が、どのモデルから始めるかを決めます。
フロンティア価格を払える(出力 $50+/100万)
最難関の agent 作業には Fable 5($10/$50)、デフォルトラインには Opus 5($5/$25)——公表ベンチマークで同じ能力帯、30日保持なし。これが推奨する Claude 2層構成です。
出力 $15/100万以内で堅実なモデルが欲しい
Sonnet 5($2/$10、2026-08-31までの導入価格)、Gemini 3.1 Pro($2/$12、200K以内のプロンプト)または Kimi K3($3/$15)。Sonnet 5 は Claude エコシステム内。Gemini と K3 はそれぞれマルチモーダルの広さとオープンウェイトを提供します。
コスト重視または大量トラフィック
GPT-5.5($5/$30、安価な非推論モード $1.25/$10)、GLM 5.2(Z.ai で約 $1.40/$4.40)、DeepSeek V4 Pro($0.435/$0.87)または DeepSeek V4 Flash($0.14/$0.28)。Flash は市場で最安の本格コーディングモデル——入力価格は Fable 5 の約70分の1です。
オープンウェイトまたはセルフホストが必要
GLM 5.2(MIT ライセンス、Ollama で無料)、DeepSeek V4 Pro と V4 Flash(Flash は MIT)、または Kimi K3(約1.4TBのウェイト、H100 級 GPU 約18枚が必要——ノートPC向けではなくフリートプロジェクト)。Qwen 3.8 Max は2026年8月3日に「来週」オープンソース化を発表しましたが未公開——not confirmed。
選定ガイド —— タスク別
正直な答えはほとんどの場合「両方、タスクでルーティング」。タスク別の判断は以下です。
エージェント型コーディング・長時間の自律実行
Fable 5(SWE-Bench Pro 80.3%)または Opus 5——公表値で最高の2モデル。Opus 5 は半額。GPT-5.5 は 58.6% で後れ、GLM 5.2 は 62.1% で中程度の複雑さの単一ファイル作業に十分。
日常・中程度の複雑さのコーディング
ミッドティアのモデルならどれでも合格:Sonnet 5、GPT-5.5、GLM 5.2、DeepSeek V4 Pro または Flash。価格とエコシステムで選びます。Fable 5 はここでは過剰で、プレミアムが回収できることは稀です。
長いコンテキスト(1M トークン窓)
Fable 5・Opus 5・Sonnet 5・Gemini 3.1 Pro・GLM 5.2・DeepSeek V4 Pro/Flash・Qwen 3.8 Max・Kimi K3 はすべて 1M コンテキスト対応。GPT-5.5 は 400K 上限。コンテキスト中心のトラフィックでは安いモデルが価格で勝ち、リポジトリ全体の深い推論では Fable 5 です。
中国語または中国ホスティングの業務
Kimi K3(BenchAlign v5 中国語ラボランキング首位、中国ホスティング API)または Qwen 3.8 Max(Alibaba Cloud、人民元請求、約 $2/$6)。Fable 5 は米国輸出管理対象の海外 API——データを中国に置く必要がある場合は大きな欠点です。
画像・動画・音声入力
Gemini 3.1 Pro(MMMU-Pro 1位)が最も広いマルチモーダルスタック。Qwen 3.8 Max はテキスト・画像・動画入力に対応。Fable 5 も画像と PDF 入力はできますが、メディア中心のワークフローは強みではありません。
選定ガイド —— ハードな制約別
ベンチマークより先に決まる要件があります。
Anthropic API に留まる必要がある
選択は内部で完結します:最難関の agent 作業に Fable 5、デフォルトラインに Opus 5(半額)、大量・予算重視に Sonnet 5。3モデルとも同じ API 面・キャッシュ・ツールチェーンを共有します。
ゼロデータ保持が必要
Fable 5 の強制30日保持(ゼロ保持契約は適用不可)は選定から除外されます。Opus 5 と Sonnet 5 は保持要件なし。Gemini 3.1 Pro のガバナンスは異なり Google の規約に従います。
停止され得ないモデルが必要
Fable 5 は米国の輸出管理指令により2026年6月12日〜7月1日まで全世界で停止され、原理上再発の可能性があります。MIT ライセンスのオープンウェイト(GLM 5.2、DeepSeek V4 Flash、まもなく Qwen 3.8 Max)は取り消せません——国際・エンタープライズチームにとって決定的な論拠です。
オープンウェイトまたはセルフホストが必要
GLM 5.2(MIT)、DeepSeek V4 Flash(MIT)または Kimi K3(Modified MIT、条件は完全には未確認)。Anthropic のモデルはどれもオープンではありません。Qwen 3.8 Max のウェイトは発表済みですが2026-08-04時点で未公開です。
Google または OpenAI のエコシステムにいる
Google スタック(Workspace・Vertex・Gemini アプリ無料層)なら Gemini 3.1 Pro。OpenAI スタック(構造化出力・Assistants)なら GPT-5.5。乗り換えコストがベンチマーク差を上回ることが多いです。
決定ツリーの要約
3つの質問、それぞれ1つの答え——その後で完全比較へ。
質問1——予算:出力が100万トークンあたり約$50を超えるなら Fable 5 か Opus 5 をエスカレーションラインに。未満ならミッドティア(Sonnet 5、Gemini 3.1 Pro、GPT-5.5、Kimi K3)かローティア(GLM 5.2、DeepSeek V4 Pro/Flash、Qwen 3.8 Max)から。質問2——タスク:フロンティア級の agent コーディング・長時間の自律実行・リポジトリ全体の 1M 分析は Fable 5 を。それ以外は「品質ラインを満たす最安モデル」。質問3——制約:Anthropic 必須・ゼロ保持必須・オープンウェイト必須・中国ホスティング必須——いずれも最初の2問より優先します。
すべてのマトリクスに通じる原則:Fable 5 のプレミアムが報われるのは、「安いモデルが実際に失敗し、再試行(または人手)に実費がかかる」仕事だけです。成功する最安のラインを使い、難しい10〜20%だけ Fable 5 にエスカレーションしましょう。
エビデンスのパリティ —— 同じハーネスを共有する数字
一貫しないベンチマークに惑わされずに表を読む方法。
同一ハーネスの比較
Fable 5(80.3%)と GPT-5.5(58.6%)は、同じハーネス定義とスコアリングプロトコルを共有する唯一の SWE-Bench Pro 数字ペア——直接比較できる唯一の行です(各ラボが設定を選択した上での話)。
独立計測された数字
GDPval-AA 1932(Fable 5)と 1769(GPT-5.5)は Artificial Analysis の計測。Kimi K3 の DeepSWE 68.5% 対 Fable 5 の 69.9%(Together AI、2026年8月、pass@1)は、このラインナップで唯一の独立した直接対決です。他はすべてベンダー自己申告です。
DeepSeek の主張
V4 Flash は SWE-Bench Verified 79.0%・LiveCodeBench 91.6 を報告(公式テクニカルレポート、独立検証なし)。7月31日の agent 能力強化の主張も独立検証がありません。Flash・Pro とも SWE-Bench Pro の数字は存在せず——2026-08-04時点で not confirmed。
Qwen 3.8 Max の主張
Alibaba は LMArena で「Fable 5 に次ぐ」と主張し、agent 型コンピューター操作のリード(OSWorld-Verified 86.1、ベンダー自己申告)も主張しますが、ローンチ時にモデルカードもベンチマーク表も出しませんでした——2026-08-04時点で未検証。
Kimi K3 の主張
Moonshot は DeepSWE 67.5%(max 推論)を Fable 5 の 70.0% に対して自己申告。独立した Together AI の計測ではほぼ互角(68.5% 対 69.9% pass@1)。K3 に SWE-Bench Pro の公表スコアはありません。ライセンス条件も完全には未確認です。
まだ決めかねていますか?
最も深い比較——Claude の選択の大半を決める Fable 5 vs Opus 5——を読むか、実際のワークロードをコスト計算ツールで試算してください。