Kimi K3 対 Claude Fable 5.1:オープンウェイト vs アップデートされたクローズド旗艦
Moonshot Kimi K3($3/$15・オープンウェイト・中国語に強い)対 Claude Fable 5.1(2026-09-02 リリース、SWE-bench 87.7%、$10/$50)——コーディングベンチマーク、価格、自前ホスト、そして中国語対応でどちらを選ぶべきか。

Fable 5.1(2026-09-02)向けに更新。 出典付きベンチマーク表と意思決定マトリクスを継続更新している比較は Claude Fable 5.1 vs Kimi K3 ページにあります。2026年8月の Fable 5 vs K3 分析 は歴史的参照として残しています。
Anthropic は 2026 年 9 月 2 日、Claude Fable 5.1 を出荷しました——SWE-bench Verified 87.7%、API は引き続き $10/$50、モデル文字列は claude-fable-5-1-20260902 に差し替えるだけでアップグレード可能です。Moonshot AI の Kimi K3(2026-07-16 発表、7 月 27 日オープンウェイト)も止まっていません:$3/$15、2.8T オープンウェイト、1M コンテキスト、そしてこのクラス最強の中国語ストーリー。5.1 アップデート後の正直な比較を、すべてのベンチマークに測定元を明記して示します。
Kimi K3 対 Claude Fable 5.1:短い答え
Fable 5.1 がフロンティア・コーディングの差を広げた。Kimi K3 はコスト・オープン性・中国語の作業で依然優位。 Fable 5.1 の公式 87.7% SWE-bench Verified(Fable 5 比 +7.4 ポイント)は、エージェント型コーディングで Anthropic とすべてのオープン挑戦者の距離をさらに広げました。K3 の同一テスト名での自己申告 71.2% はオープンモデルとして競争力がありますが、最難タスクでは 5.1 と同じ tier ではありません。K3 が Fable 5.1 に与えられないものは、自前ホスト可能なオープンウェイト(本物のハードウェアは必要)、約 3 分の 1 の API 価格、Moonshot の中国語強み——維持比較表では中国語評価 97.2% vs 91.5%。Fable 5.1 が K3 に与えられないものは、最高公開エージェント型コーディングスコア、Anthropic エコシステム、誤 safeguard フォールバックが少ない Fable 級の自律性です。
一覧
| 仕様 | Kimi K3 | Claude Fable 5.1 |
|---|---|---|
| ベンダー | Moonshot AI(中国) | Anthropic(米国) |
| リリース | 2026年7月16日(ウェイト 7月27日) | 2026年9月2日 |
| パラメータ | 2.8T 総量、約 50B アクティブ(16/896 エキスパート) | 非公開(Mythos クラス) |
| コンテキスト | 1M(1,048,576) | 1M |
| オープン性 | オープンウェイト(MXFP4 約 1.4TB);ライセンス未完全確認 | クローズド API のみ |
| API 価格(100 万トークンあたり) | 入力 $3 / 出力 $15(キャッシュ $0.30)——Moonshot 公式 | 入力 $10 / 出力 $50(キャッシュ $1) |
| 利用可能チャネル | Moonshot API(中国向け);Together、SiliconFlow、OpenRouter | Anthropic API + Max/Team |
| 自前ホスト | 可——H100 80GB 級 GPU 約 18 枚 | 不可 |
ベンチマーク:誰が測ったか
| ベンチマーク | Kimi K3 | Claude Fable 5.1 | 測定元 |
|---|---|---|---|
| SWE-bench Verified | 71.2% | 87.7% | K3:Moonshot 自己申告。5.1:Anthropic 公式(2026-09-02) |
| FrontierMath | 26.8% | 38.2% | K3:Moonshot 自己申告。5.1:Anthropic 公式 |
| Humanity's Last Exam (HLE) | 48.5% | 61.4% | K3:Moonshot 自己申告。5.1:Anthropic 公式 |
| 中国語評価(維持セット) | 97.2% | 91.5% | ランディングページ表(2026-09) |
| 長コンテキスト検索(1M) | 98.6% | 99.8% | ランディングページ表 |
| DeepSWE pass@1 | 68.5% | 69.9%(Fable 5 ベースライン) | Together AI 独立計測(2026-08) |
| BenchAlign v5 中国ラボ総合 | 第 1(79.8) | N/A(米国ラボ) | BenchAlign 独立(2026-08) |
正直な読み方:5.1 がフロンティアの天井を引き上げた。K3 の価値提案は raw エージェント型コーディング parity ではなく、価格・主権・中国語品質へシフトした。 出典付きの完全表は Fable 5.1 vs Kimi K3 ランディングページ を参照。
コスト:実ワークロードでの比較
月 100 万回のエージェント呼び出し、各回平均入力 5,000 トークン・出力 1,500 トークンと仮定:
| Kimi K3(API) | Claude Fable 5.1(API) | |
|---|---|---|
| 入力単価(100 万トークンあたり) | $3.00 | $10.00 |
| 出力単価(100 万トークンあたり) | $15.00 | $50.00 |
| 月間入力コスト(50 億トークン) | $15,000 | $50,000 |
| 月間出力コスト(15 億トークン) | $22,500 | $75,000 |
| 月間合計 | $37,500 | $125,000 |
Fable 5.1 の API 定価は 約 3.3 倍——ただし 5.1 の適応的思考により難タスクの実質トークンは 20–35% 削減可能(リリースベンチマーク記事)。コスト計算機で自分のワークロードを試算してください。
K3 の自前ホスト? オープンウェイトは API 限界コストをハードウェア請求に置き換えます——H100 80GB 級アクセラレータ約 18 枚、クラウド予約で月約 $36,000(運用別)。月 100 万回呼び出しでは K3 API($37,500)と同等。自前ホストは節約ではなくデータ管理のためです。
Kimi K3 が勝つ場面
- 中国語品質: 維持比較で中国語評価が 5.1 を上回る。中国向け API。BenchAlign v5 中国ラボ首位。
- オープンウェイトとデータ主権: 自前ホストまたは任意のプロバイダ——米国輸出管理スイッチなし、30 日強制保持 なし。
- 価格: API 定価で Fable 5.1 より約 3.3 倍安い。
- フロントエンドコーディング: Arena WebDev 首位の初の中国モデル(暫定、2026-08)。
Claude Fable 5.1 が勝つ場面
- 最高公開コーディングスコア: 87.7% SWE-bench Verified——Fable ライン開始以来、オープン挑戦者に対する最大の公式リード。
- フロンティア数学・推論: 38.2% FrontierMath、61.4% HLE——いずれも K3 自己申告を大きく上回る。
- 長期自律: ファイルメモリ、適応的思考バジェット、誤 safeguard フォールバック -73%(Fable 5 比)。
- エコシステム: Claude Code、Cursor、Max/Team が Fable ライン中心。
DeepSeek のオープン挑戦者は Fable 5.1 vs DeepSeek コーディング。5.1 リリースの詳細は Claude Fable 5.1 リリースベンチマーク。
意思決定マトリクス
- 中国語ユーザーまたは中国データ residency → Kimi K3(Moonshot API または自前ホスト)。
- 自前ホストまたはデータ主権 → Kimi K3——まず コスト計算機 で約 18 GPU の予算を確認。
- ルーティン/中程度コーディングで単位コスト優先 → Kimi K3、定価で約 3 倍——実リポジトリでテストを。
- 最難 agentic コーディングまたは複数日自律 → Claude Fable 5.1——87.7% SWE-bench が決定要因。
- すでに Anthropic Max/Team → Fable 5.1 のまま。サブスクが API 差を吸収。アップグレードはモデル文字列変更のみ。
- 誰の許可もなくオン/オフしたい → Kimi K3——2026-07-27 からオープンウェイト。
2026-09-04 時点の独立分析。Fable 5 代替ガイド、Fable 5.1 vs Kimi K3 ランディングページ で全選択肢を比較するか、ベンチマーク解説 を読んでから単一数字を信じないでください。