最終確認:2026年8月4日

Claude Fable 5 —— 全モデル比較ハブ

全体像を一枚で把握:Claude Fable 5 を Anthropic 自社ラインアップと 2026 年の主要なライバルすべてと比較——価格、エージェント型コーディング、コンテキスト、オープン性、最適な用途。すべての数字に日付と出典を添え、各モデルの完全比較ページへのリンクも用意しました。

TL;DR —— Fable 5 を一言で

Claude Fable 5 は Anthropic が公表した中で最高のエージェント型コーディング性能を持つモデル——SWE-Bench Pro 80.3%、100万トークンあたり $10/$50——ですが、もはや Claude のデフォルトではありません。2026年7月24日以降、Claude Max のデフォルトモデルは Claude Opus 5 で、Fable 5 の能力帯を半額($5/$25)で提供し、強制データ保持もありません。最難関のエージェント作業——長時間の自律実行、フロンティア級コーディング、リポジトリ全体の 1M 分析——には Fable 5 を、それ以外には Opus 5(または安価なライバル)を選びましょう。下表で9つの代替案を一望できます。

最終確認日2026-08-04

本ページの価格とベンチマークは、2026年8月4日に記載の出典と照合済みです。Anthropic の数字は src/lib/model-pricing.ts(Anthropic 価格ドキュメントと照合)に基づきます。競合の数字は当サイトの個別比較ページ(各ページに日付と出典)と後述のベンダーページに基づきます。確認できなかった数字は「not confirmed」と日付を付して表記しています。

マスター比較マトリクス

API 定価(100万トークンあたり、米ドル)と、ほとんどの選定を左右する要点。詳細と注記は以下および各比較ページにあります。

モデル入力(100万あたり)出力(100万あたり)コンテキストオープンウェイト最適な用途出典
Claude Fable 5$10.00$50.001MClosed APIフロンティア級 agent コーディング公式(ベンダー文書)
Claude Opus 5$5.00$25.001MClosed APIデフォルトライン・保持なし公式(ベンダー文書)
Claude Sonnet 5$2.00*$10.00*1MClosed APIバランス型 Claude ティア公式(ベンダー文書)
Gemini 3.1 Pro$2.00$12.001MClosed APIマルチモーダル・Google 連携公式(ベンダー文書)
GPT-5.5$5.00$30.00400KClosed APIOpenAI エコシステム製品公式(ベンダー文書)
GLM 5.2~$1.40~$4.401MOpen weights (MIT)無料ローカル・オープンウェイトベンダー自己申告
DeepSeek V4 Pro$0.435$0.871MOpen weights低価格・高推論ベンダー自己申告
DeepSeek V4 Flash$0.14$0.281MOpen weights (MIT)大量処理・コモディティベンダー自己申告
Qwen 3.8 Max≈$2.00≈$6.001MAnnounced, not released中国 + 価格ベンダー自己申告
Kimi K3$3.00$15.001MOpen weights中国語 + オープンウェイトベンダー自己申告

Sonnet 5 の価格は 2026-08-31 までの導入価格です。Gemini 3.1 Pro の料金は 200K トークンまでのプロンプトに適用(超過分は上位レート)。GPT-5.5 の料金は 272K まで(超過は長文脈レート)、より安い非推論モード $1.25/$10 もあります。GLM 5.2・DeepSeek V4 Pro/Flash・Qwen 3.8 Max・Kimi K3 の価格はベンダー自己申告で独立検証はされていません。Qwen の $2/$6 は国際定価の推定値——詳細はベンチマーク表の下の注記を参照。「公式」= ベンダー文書、「ベンダー自己申告」= ベンダー発表で未検証です。

主要ベンチマークマトリクス —— 誰が測ったか

公表数字のあるモデルのエージェント型コーディングとナレッジワークのスコア。すべての数字に出典を明記しています。ラボ公表の数字は方向性の参考として扱ってください。

モデルClaude Fable 5Claude Opus 5GPT-5.5GLM 5.2
SWE-Bench Pro(エージェント型コーディング)80.3%Not confirmed(2026-08-04時点)58.6%62.1%
FrontierCode Diamond(高難度コーディング)29.3%公表スコアなし5.7%公表スコアなし
GDPval-AA(ナレッジワーク)1932公表スコアなし1769公表スコアなし
OSWorld-Verified(コンピューター操作)85.0%公表スコアなし78.7%公表スコアなし

出典:Fable 5・Opus 5・Sonnet 5 は Anthropic の2026年6月9日ローンチ発表とモデルドキュメント(ベンダー自己申告、2026年8月4日に Anthropic ソースと照合)。GPT-5.5 は OpenAI の発表(ベンダー自己申告)。GLM 5.2 の SWE-Bench Pro 62.1% と FrontierSWE 74.4% は GLM 5.2 テクニカルレポート(2026年6月、ベンダー自己申告);同表の Opus 4.8 と GPT-5.5 の列は Anthropic / OpenAI の数字。Gemini 3.1 Pro・DeepSeek V4 Pro・DeepSeek V4 Flash・Qwen 3.8 Max・Kimi K3 は2026年8月4日時点で SWE-Bench Pro の公表スコアがありません——推測せずその旨を明記しています。

エビデンスのパリティ:Fable 5 の 80.3% と GPT-5.5 の 58.6% は、同じハーネス定義とスコアリングプロトコルを共有する唯一の SWE-Bench Pro 数字ペアです(各ラボが設定を選択した上で)。GLM 5.2 の 62.1% は異なるハーネス実装に基づき、直接比較はできません。GDPval-AA 1932(Fable 5)と 1769(GPT-5.5)は Artificial Analysis の計測(独立)。2026-08-04時点で、Fable 5 以外に独立検証済みの SWE-Bench Pro スコアを持つモデルはありません。Fable 5 の全ベンチマークはベンチマーク解説ページを参照。

選定ガイド —— 予算別

価格上限が、どのモデルから始めるかを決めます。

  • フロンティア価格を払える(出力 $50+/100万)

    最難関の agent 作業には Fable 5($10/$50)、デフォルトラインには Opus 5($5/$25)——公表ベンチマークで同じ能力帯、30日保持なし。これが推奨する Claude 2層構成です。

  • 出力 $15/100万以内で堅実なモデルが欲しい

    Sonnet 5($2/$10、2026-08-31までの導入価格)、Gemini 3.1 Pro($2/$12、200K以内のプロンプト)または Kimi K3($3/$15)。Sonnet 5 は Claude エコシステム内。Gemini と K3 はそれぞれマルチモーダルの広さとオープンウェイトを提供します。

  • コスト重視または大量トラフィック

    GPT-5.5($5/$30、安価な非推論モード $1.25/$10)、GLM 5.2(Z.ai で約 $1.40/$4.40)、DeepSeek V4 Pro($0.435/$0.87)または DeepSeek V4 Flash($0.14/$0.28)。Flash は市場で最安の本格コーディングモデル——入力価格は Fable 5 の約70分の1です。

  • オープンウェイトまたはセルフホストが必要

    GLM 5.2(MIT ライセンス、Ollama で無料)、DeepSeek V4 Pro と V4 Flash(Flash は MIT)、または Kimi K3(約1.4TBのウェイト、H100 級 GPU 約18枚が必要——ノートPC向けではなくフリートプロジェクト)。Qwen 3.8 Max は2026年8月3日に「来週」オープンソース化を発表しましたが未公開——not confirmed。

選定ガイド —— タスク別

正直な答えはほとんどの場合「両方、タスクでルーティング」。タスク別の判断は以下です。

  • エージェント型コーディング・長時間の自律実行

    Fable 5(SWE-Bench Pro 80.3%)または Opus 5——公表値で最高の2モデル。Opus 5 は半額。GPT-5.5 は 58.6% で後れ、GLM 5.2 は 62.1% で中程度の複雑さの単一ファイル作業に十分。

  • 日常・中程度の複雑さのコーディング

    ミッドティアのモデルならどれでも合格:Sonnet 5、GPT-5.5、GLM 5.2、DeepSeek V4 Pro または Flash。価格とエコシステムで選びます。Fable 5 はここでは過剰で、プレミアムが回収できることは稀です。

  • 長いコンテキスト(1M トークン窓)

    Fable 5・Opus 5・Sonnet 5・Gemini 3.1 Pro・GLM 5.2・DeepSeek V4 Pro/Flash・Qwen 3.8 Max・Kimi K3 はすべて 1M コンテキスト対応。GPT-5.5 は 400K 上限。コンテキスト中心のトラフィックでは安いモデルが価格で勝ち、リポジトリ全体の深い推論では Fable 5 です。

  • 中国語または中国ホスティングの業務

    Kimi K3(BenchAlign v5 中国語ラボランキング首位、中国ホスティング API)または Qwen 3.8 Max(Alibaba Cloud、人民元請求、約 $2/$6)。Fable 5 は米国輸出管理対象の海外 API——データを中国に置く必要がある場合は大きな欠点です。

  • 画像・動画・音声入力

    Gemini 3.1 Pro(MMMU-Pro 1位)が最も広いマルチモーダルスタック。Qwen 3.8 Max はテキスト・画像・動画入力に対応。Fable 5 も画像と PDF 入力はできますが、メディア中心のワークフローは強みではありません。

選定ガイド —— ハードな制約別

ベンチマークより先に決まる要件があります。

  • Anthropic API に留まる必要がある

    選択は内部で完結します:最難関の agent 作業に Fable 5、デフォルトラインに Opus 5(半額)、大量・予算重視に Sonnet 5。3モデルとも同じ API 面・キャッシュ・ツールチェーンを共有します。

  • ゼロデータ保持が必要

    Fable 5 の強制30日保持(ゼロ保持契約は適用不可)は選定から除外されます。Opus 5 と Sonnet 5 は保持要件なし。Gemini 3.1 Pro のガバナンスは異なり Google の規約に従います。

  • 停止され得ないモデルが必要

    Fable 5 は米国の輸出管理指令により2026年6月12日〜7月1日まで全世界で停止され、原理上再発の可能性があります。MIT ライセンスのオープンウェイト(GLM 5.2、DeepSeek V4 Flash、まもなく Qwen 3.8 Max)は取り消せません——国際・エンタープライズチームにとって決定的な論拠です。

  • オープンウェイトまたはセルフホストが必要

    GLM 5.2(MIT)、DeepSeek V4 Flash(MIT)または Kimi K3(Modified MIT、条件は完全には未確認)。Anthropic のモデルはどれもオープンではありません。Qwen 3.8 Max のウェイトは発表済みですが2026-08-04時点で未公開です。

  • Google または OpenAI のエコシステムにいる

    Google スタック(Workspace・Vertex・Gemini アプリ無料層)なら Gemini 3.1 Pro。OpenAI スタック(構造化出力・Assistants)なら GPT-5.5。乗り換えコストがベンチマーク差を上回ることが多いです。

決定ツリーの要約

3つの質問、それぞれ1つの答え——その後で完全比較へ。

質問1——予算:出力が100万トークンあたり約$50を超えるなら Fable 5 か Opus 5 をエスカレーションラインに。未満ならミッドティア(Sonnet 5、Gemini 3.1 Pro、GPT-5.5、Kimi K3)かローティア(GLM 5.2、DeepSeek V4 Pro/Flash、Qwen 3.8 Max)から。質問2——タスク:フロンティア級の agent コーディング・長時間の自律実行・リポジトリ全体の 1M 分析は Fable 5 を。それ以外は「品質ラインを満たす最安モデル」。質問3——制約:Anthropic 必須・ゼロ保持必須・オープンウェイト必須・中国ホスティング必須——いずれも最初の2問より優先します。

すべてのマトリクスに通じる原則:Fable 5 のプレミアムが報われるのは、「安いモデルが実際に失敗し、再試行(または人手)に実費がかかる」仕事だけです。成功する最安のラインを使い、難しい10〜20%だけ Fable 5 にエスカレーションしましょう。

エビデンスのパリティ —— 同じハーネスを共有する数字

一貫しないベンチマークに惑わされずに表を読む方法。

  • 同一ハーネスの比較

    Fable 5(80.3%)と GPT-5.5(58.6%)は、同じハーネス定義とスコアリングプロトコルを共有する唯一の SWE-Bench Pro 数字ペア——直接比較できる唯一の行です(各ラボが設定を選択した上での話)。

  • 独立計測された数字

    GDPval-AA 1932(Fable 5)と 1769(GPT-5.5)は Artificial Analysis の計測。Kimi K3 の DeepSWE 68.5% 対 Fable 5 の 69.9%(Together AI、2026年8月、pass@1)は、このラインナップで唯一の独立した直接対決です。他はすべてベンダー自己申告です。

  • DeepSeek の主張

    V4 Flash は SWE-Bench Verified 79.0%・LiveCodeBench 91.6 を報告(公式テクニカルレポート、独立検証なし)。7月31日の agent 能力強化の主張も独立検証がありません。Flash・Pro とも SWE-Bench Pro の数字は存在せず——2026-08-04時点で not confirmed。

  • Qwen 3.8 Max の主張

    Alibaba は LMArena で「Fable 5 に次ぐ」と主張し、agent 型コンピューター操作のリード(OSWorld-Verified 86.1、ベンダー自己申告)も主張しますが、ローンチ時にモデルカードもベンチマーク表も出しませんでした——2026-08-04時点で未検証。

  • Kimi K3 の主張

    Moonshot は DeepSWE 67.5%(max 推論)を Fable 5 の 70.0% に対して自己申告。独立した Together AI の計測ではほぼ互角(68.5% 対 69.9% pass@1)。K3 に SWE-Bench Pro の公表スコアはありません。ライセンス条件も完全には未確認です。

自分のワークロードで数字を動かす

コスト計算ツールは現在 Anthropic 自社ラインアップ(Fable 5・Opus 5・Sonnet 5 など)のみを対象とし、effort レベル・キャッシュ・セーフガード分流を考慮します。競合モデルへの切替には未対応——競合比較には、上のマトリクスの定価と、各比較ページの試算例をお使いください。

まだ決めかねていますか?

最も深い比較——Claude の選択の大半を決める Fable 5 vs Opus 5——を読むか、実際のワークロードをコスト計算ツールで試算してください。

よくある質問