ブログに戻る

Kimi K3 対 Claude Fable 5.1:オープンウェイト vs アップデートされたクローズド旗艦

Moonshot Kimi K3($3/$15・オープンウェイト・中国語に強い)対 Claude Fable 5.1(2026-09-02 リリース、SWE-bench 87.7%、$10/$50)——コーディングベンチマーク、価格、自前ホスト、そして中国語対応でどちらを選ぶべきか。

2026年9月4日Fable5 編集部Fable5 編集部
Kimi K3 対 Claude Fable 5.1:オープンウェイト vs アップデートされたクローズド旗艦

Fable 5.1(2026-09-02)向けに更新。 出典付きベンチマーク表と意思決定マトリクスを継続更新している比較は Claude Fable 5.1 vs Kimi K3 ページにあります。2026年8月の Fable 5 vs K3 分析 は歴史的参照として残しています。

Anthropic は 2026 年 9 月 2 日、Claude Fable 5.1 を出荷しました——SWE-bench Verified 87.7%、API は引き続き $10/$50、モデル文字列は claude-fable-5-1-20260902 に差し替えるだけでアップグレード可能です。Moonshot AIKimi K3(2026-07-16 発表、7 月 27 日オープンウェイト)も止まっていません:$3/$15、2.8T オープンウェイト、1M コンテキスト、そしてこのクラス最強の中国語ストーリー。5.1 アップデート後の正直な比較を、すべてのベンチマークに測定元を明記して示します。

Kimi K3 対 Claude Fable 5.1:短い答え

Fable 5.1 がフロンティア・コーディングの差を広げた。Kimi K3 はコスト・オープン性・中国語の作業で依然優位。 Fable 5.1 の公式 87.7% SWE-bench Verified(Fable 5 比 +7.4 ポイント)は、エージェント型コーディングで Anthropic とすべてのオープン挑戦者の距離をさらに広げました。K3 の同一テスト名での自己申告 71.2% はオープンモデルとして競争力がありますが、最難タスクでは 5.1 と同じ tier ではありません。K3 が Fable 5.1 に与えられないものは、自前ホスト可能なオープンウェイト(本物のハードウェアは必要)、約 3 分の 1 の API 価格、Moonshot の中国語強み——維持比較表では中国語評価 97.2% vs 91.5%。Fable 5.1 が K3 に与えられないものは、最高公開エージェント型コーディングスコア、Anthropic エコシステム、誤 safeguard フォールバックが少ない Fable 級の自律性です。

一覧

仕様Kimi K3Claude Fable 5.1
ベンダーMoonshot AI(中国)Anthropic(米国)
リリース2026年7月16日(ウェイト 7月27日)2026年9月2日
パラメータ2.8T 総量、約 50B アクティブ(16/896 エキスパート)非公開(Mythos クラス)
コンテキスト1M(1,048,576)1M
オープン性オープンウェイト(MXFP4 約 1.4TB);ライセンス未完全確認クローズド API のみ
API 価格(100 万トークンあたり)入力 $3 / 出力 $15(キャッシュ $0.30)——Moonshot 公式入力 $10 / 出力 $50(キャッシュ $1)
利用可能チャネルMoonshot API(中国向け);Together、SiliconFlow、OpenRouterAnthropic API + Max/Team
自前ホスト可——H100 80GB 級 GPU 約 18 枚不可

ベンチマーク:誰が測ったか

ベンチマークKimi K3Claude Fable 5.1測定元
SWE-bench Verified71.2%87.7%K3:Moonshot 自己申告。5.1:Anthropic 公式(2026-09-02)
FrontierMath26.8%38.2%K3:Moonshot 自己申告。5.1:Anthropic 公式
Humanity's Last Exam (HLE)48.5%61.4%K3:Moonshot 自己申告。5.1:Anthropic 公式
中国語評価(維持セット)97.2%91.5%ランディングページ表(2026-09)
長コンテキスト検索(1M)98.6%99.8%ランディングページ表
DeepSWE pass@168.5%69.9%(Fable 5 ベースライン)Together AI 独立計測(2026-08)
BenchAlign v5 中国ラボ総合第 1(79.8)N/A(米国ラボ)BenchAlign 独立(2026-08)

正直な読み方:5.1 がフロンティアの天井を引き上げた。K3 の価値提案は raw エージェント型コーディング parity ではなく、価格・主権・中国語品質へシフトした。 出典付きの完全表は Fable 5.1 vs Kimi K3 ランディングページ を参照。

コスト:実ワークロードでの比較

月 100 万回のエージェント呼び出し、各回平均入力 5,000 トークン・出力 1,500 トークンと仮定:

Kimi K3(API)Claude Fable 5.1(API)
入力単価(100 万トークンあたり)$3.00$10.00
出力単価(100 万トークンあたり)$15.00$50.00
月間入力コスト(50 億トークン)$15,000$50,000
月間出力コスト(15 億トークン)$22,500$75,000
月間合計$37,500$125,000

Fable 5.1 の API 定価は 約 3.3 倍——ただし 5.1 の適応的思考により難タスクの実質トークンは 20–35% 削減可能(リリースベンチマーク記事)。コスト計算機で自分のワークロードを試算してください。

K3 の自前ホスト? オープンウェイトは API 限界コストをハードウェア請求に置き換えます——H100 80GB 級アクセラレータ約 18 枚、クラウド予約で月約 $36,000(運用別)。月 100 万回呼び出しでは K3 API($37,500)と同等。自前ホストは節約ではなくデータ管理のためです。

Kimi K3 が勝つ場面

  • 中国語品質: 維持比較で中国語評価が 5.1 を上回る。中国向け API。BenchAlign v5 中国ラボ首位。
  • オープンウェイトとデータ主権: 自前ホストまたは任意のプロバイダ——米国輸出管理スイッチなし、30 日強制保持 なし。
  • 価格: API 定価で Fable 5.1 より約 3.3 倍安い。
  • フロントエンドコーディング: Arena WebDev 首位の初の中国モデル(暫定、2026-08)。

Claude Fable 5.1 が勝つ場面

  • 最高公開コーディングスコア: 87.7% SWE-bench Verified——Fable ライン開始以来、オープン挑戦者に対する最大の公式リード。
  • フロンティア数学・推論: 38.2% FrontierMath61.4% HLE——いずれも K3 自己申告を大きく上回る。
  • 長期自律: ファイルメモリ、適応的思考バジェット、誤 safeguard フォールバック -73%(Fable 5 比)。
  • エコシステム: Claude Code、Cursor、Max/Team が Fable ライン中心。

DeepSeek のオープン挑戦者は Fable 5.1 vs DeepSeek コーディング。5.1 リリースの詳細は Claude Fable 5.1 リリースベンチマーク

意思決定マトリクス

  • 中国語ユーザーまたは中国データ residency → Kimi K3(Moonshot API または自前ホスト)。
  • 自前ホストまたはデータ主権 → Kimi K3——まず コスト計算機 で約 18 GPU の予算を確認。
  • ルーティン/中程度コーディングで単位コスト優先 → Kimi K3、定価で約 3 倍——実リポジトリでテストを。
  • 最難 agentic コーディングまたは複数日自律 → Claude Fable 5.1——87.7% SWE-bench が決定要因。
  • すでに Anthropic Max/Team → Fable 5.1 のまま。サブスクが API 差を吸収。アップグレードはモデル文字列変更のみ。
  • 誰の許可もなくオン/オフしたい → Kimi K3——2026-07-27 からオープンウェイト。

2026-09-04 時点の独立分析。Fable 5 代替ガイドFable 5.1 vs Kimi K3 ランディングページ で全選択肢を比較するか、ベンチマーク解説 を読んでから単一数字を信じないでください。

関連記事