Claude Fable 5 は実際何が得意なのか?ユースケースと限界
Fable 5 が価格に見合う5つのワークロード、誰もが尋ねる能力の疑問(画像生成は?動画は?文章は?)、そして安いモデルに任せるべき3つの仕事。

ローンチ週の問いは「どれくらい強いのか?」だった。Google に実際に打ち込まれている言葉を見ると、2週目の問いはもっと実務的だ:何に強いのか? これがその正直な地図——Fable 5 がプレミアムに見合う5つの場面、誰もが尋ねる能力の疑問、そしてこのモデルに金を払うのが単なる無駄になる3つの仕事。
一段落版の答え
Claude Fable 5 は長期・自律型の仕事のために作られている:ステップが多く、ファイルが多く、ツール呼び出しが多いタスク——人間が毎ターン舵を取らなくても、モデル自身が計画を保持し、自分のミスから立ち直る必要がある仕事だ。ベンチマークが描くのも、価格が前提とするのも、このプロファイルである。あなたのタスクがそこから遠いほど、これを使う理由は薄れる。
明確に勝つ5つのワークロード
1. リポジトリレベルのソフトウェアエンジニアリング
看板の数字——SWE-bench Pro 80.3%、SWE-bench Verified 95.0%——は、実在のコードベースで実在の GitHub issue を解決する力を測る。Opus 4.8 への11ポイント差はマルチファイル推論に集中している:相互接続されたモジュールに波及する変更、つまり影響範囲の理解こそが難所であるタスクだ。
2. 大規模リファクタリングと移行
「任せて席を立てる」類の仕事:フレームワーク移行、数百ファイルにまたがる依存関係の更新、テストスイートの近代化。Fable 5 は20〜50ステップの連続チェーンを前世代より明確に高い率で完走する——チェーン途中のエラーが少ないほど、高くつくやり直しも減る。Cursor や Claude Code の中で走らせるのが最も報われる領域だ。
3. 深いリサーチと分析
Anthropic 社内の複雑な長期分析タスク評価を初めて90%超えしたモデルだ。実務に落とすと:複数文書の統合、競合分析、デューデリジェンス型の深掘り——長いセッションの間、数十本の糸を同時にもつれさせず保持する仕事である。
4. 構造を保ち続ける長文執筆
技術文書、レポート、構造化ガイド——3,000語目で論旨が崩壊するのが失敗パターンであるような執筆だ。200語の製品紹介文なら、安いモデルが同じものを書く。
5. 視覚中心のドキュメントワーク
Fable 5 は画像を読むのが得意だ——グラフ、スクリーンショット、スキャン文書、UI の状態——一般提供モデルの視覚ベンチマークで首位に立つ。ただし方向に注意:視覚コンテンツを分析するのであって、作るのではない。
能力の疑問にまっすぐ答える
| 疑問 | 答え |
|---|---|
| 画像生成は? | 不可——読めるが描けない |
| 動画は? | 不可——脚本と絵コンテまで |
| 文章は得意? | 得意、特に構造のある長文 |
| コーディングは? | 得意——一般提供モデル中最強、上記参照 |
| AGI なのか? | 違う——最先端 ≠ 汎用知能 |
| なぜ時々遅い? | デフォルトで推論が深い;effort パラメータで深さと速度を交換 |
使うべきでない3つの仕事
- 短く仕様が明確なタスク。 関数のリネーム、短い要約、正規表現。ここでは半額の Opus 5 との品質差はほぼゼロで、レイテンシはむしろ悪いことも多い。
- 大量・コスト重視のパイプライン。 100万トークン $10/$50 の価格で、バルク分類や抽出は小さいモデルの仕事だ。ホースを向ける前に料金計算ツールで計算を。
- セキュリティ・生物学の研究領域。 弱いからではない——セーフガード分類器がそれらのセッションを静かに Opus 4.8 へ回す可能性があるからだ。その分野が本業なら、払った金額どおりのモデルが常に来るとは限らない。
あなたにとって良いかを確かめる方法
ベンチマークは分布を語るが、あなたのワークロードは一つの点だ。含まれ枠のウィンドウ(7月1日の復旧後、2026年7月7日まで——その後の変化はこちら)は史上最安の実験になる:今のモデルが失望させ続けるタスクを一つ選び、ステップに分解せず丸ごと Fable 5 に渡し——プロンプトの書き方が重要だ——結果を比較する。目に見える改善がなければ、それもまた答えであり、コストはゼロだ。
ベンチマーク数値は Anthropic のローンチ資料(2026年6月)に基づく。プロンプトジェネレーターでタスクに合わせたプロンプトを作るか、フルスペック表を確認してほしい。