ブログに戻る

Fable 5 対 Qwen 3.8 Max:Alibaba の 2.4 兆パラメータ挑戦者を検証

Qwen 3.8 Max は 2026 年 8 月 3 日に正式発表された Alibaba 最大の 2.4 兆パラメータ旗艦モデル。価格、コーディングベンチマーク、オープンウェイト、中国本土アクセスで Claude Fable 5 とどう比べるか。

2026年8月4日Fable5 編集部Fable5 編集部

Qwen 3.8 Max は Claude Fable 5 に対抗する Alibaba の回答だ——2.4 兆パラメータのマルチモーダル旗艦モデルで、2026 年 8 月 3 日発表、価格は Fable 5 の約 5 分の 1、オープンウェイトは発表翌週に予告されている。コスト重視のチームと、輸出管理リスクなしで中国本土から使えるモデルを求めるチームにとって、今年最も本格的な Fable 5 代替となる。最難のエージェント型コーディングでは Fable 5 が依然として王者だが、「Fable 5 に次ぐ」(Alibaba の主張)という言葉を真剣に検討する価値がある初の挑戦者だ。

Fable 5 対 Qwen 3.8 Max:短い答え

Qwen 3.8 Max は価格・オープン性・中国アクセスで勝り、Claude Fable 5 は検証済みのエージェント型コーディングと Anthropic エコシステムで勝る。 Alibaba は 2.4 兆パラメータ MoE 旗艦が LMArena で Anthropic の Claude ファミリーに次ぎ、エージェント型コンピュータ操作では Fable 5 を上回ると主張する——だがモデルカードもベンチマーク表も出ないままの発表で、数字はすべてベンダー報告・未検証だ。Fable 5 の SWE-Bench Pro 80.3% は依然として公開済みエージェント型コーディングの最高スコアで、価格は 100 万トークンあたり $10/$50。Qwen 3.8 Max は国内 ¥12/¥36(国際約 $2/$6)。日常のコーディング・推論・マルチモーダル作業なら Qwen 3.8 Max がはるかに安く、最難の 20% のエージェント作業なら Fable 5(または半額の Claude Opus 5)がより安全だ。

Qwen 3.8 Max の最新情報(2026 年 8 月 4 日時点)

  • 2026 年 8 月 3 日発表。7 月 19 日の Qwen3.8-Max-Preview の正式版(GA)で、小型の Qwen 3.8-27B も同時発表。
  • 総パラメータ 2.4 兆、疎 MoE アーキテクチャで 1 リクエストあたり約 950 億パラメータを活性化——Alibaba によればオープン系モデルファミリー最大(Moonshot の Kimi K3 の 2.8 兆に次ぐ)。
  • 1M トークンのコンテキスト窓、マルチモーダル入力(テキスト・画像・動画)。
  • オープンウェイトは「来週」予告、Alibaba Cloud Model Studio 経由。2026-08-04 時点でリポジトリ・ライセンス・モデルカードは未公開——未確認
  • 価格:中国国内 ¥12 / ¥36(100 万トークンあたり入出力)、国際版は約 $2 / $6(Claude Opus 5 の約 40% / 24%)。キャッシュヒット入力 ¥1.5。

一覧

仕様Qwen 3.8 MaxClaude Fable 5
ベンダーAlibaba(通義千問)Anthropic
発表日2026-08-03(GA。プレビュー 7-19)2026-06-09(米輸出管理で 6-12〜7-1 停止)
パラメータ2.4 兆、疎 MoE(活性化約 950 億)非公開
コンテキスト窓1M トークン1M トークン
最大出力非公開128K トークン
モダリティテキスト・画像・動画入力テキスト・画像・PDF 入力
API 価格(100 万トークン)国内 ¥12 / ¥36。国際約 $2 / $6$10 / $50
オープンウェイト「来週」予告——未リリースなし(Anthropic は公開しない)
データ保持30 日保持の発表なし(未確認)強制 30 日保持。ZDR 契約も対象外
中国本土アクセスAlibaba Cloud 直結・人民元請求中国国内リージョンなし、API は海外提供

ベンチマーク:ベンダー報告 vs 独立検証

ここは一字一句慎重に読む必要がある。Qwen 3.8 Max はモデルカードもベンチマーク表もないまま発表された——発表時の数字はすべて Alibaba の自己評価で、ライバルを各家のコーディングハーネス(Anthropic は Claude Code、OpenAI は Codex)で測る手法はすでに独立アナリストから疑問視されている。Fable 5 の公開スコアも Anthropic 報告であり、どちらも完全な独立監査は受けていない。

ベンチマークQwen 3.8 MaxClaude Fable 5出所と信頼性
SWE-Bench Pro(エージェント型コーディング)発表時未公開80.3%Fable 5 は Anthropic 公表。Qwen は未確認
OSWorld-Verified(コンピュータ操作)86.1、主要モデル中 1 位と主張非公開Alibaba 報告・未検証
PaperBench(コーディングエージェント)93.0(前世代比 +28.2)非公開Alibaba 報告・未検証
GPQA Diamond(科学推論)92.6非公開Alibaba 報告・未検証
Frontend Code Arena1668(世界 4 位)「Fable 5 High を下回る」と Alibaba 主張第三者アリーナ。Alibaba の Fable 主張は未検証
LMArenaテキスト 5 位・ビジョン 2 位「Claude ファミリーに次ぐ」(Alibaba の枠組み)第三者アリーナ+ベンダー枠組み

引用する前に 2 つの注意点:

  1. Fable 5 の数字も同じ疑いの目で見るべき。 公開スコアの背後にはセーフガードフォールバックがあり、フラグ付きリクエストは会話の 5% 未満で弱いモデル(サイバー→Opus 4.8、バイオ→Opus 5)に静かに転送される。そうした領域のベンチマークは必ずしも Fable 5 自身が答えたものではない。
  2. Alibaba の旗艦主張には検証ギャップがある。 16 日間の完全自律コーディングプロジェクト(「空フォルダから人を介さず」オープンソース CLI を構築)を宣伝したが、アナリストは直ちに「人間が何回介入したのか、成果はコードレビューに耐えたのか」と疑問を呈した。参考に、当サイトでは Fable 5 の実世界ベンチマーク を詳しく記録している。

コスト:本当の主役

小規模チームのエージェント型コーディング 1 か月の典型量:入力 1,000 万 + 出力 200 万トークン

Claude Fable 5Qwen 3.8 Max(国際)Qwen 3.8 Max(国内)
入力10 × $10 = $10010 × $2 = $2010 × ¥12 = ¥120
出力2 × $50 = $1002 × $6 = $122 × ¥36 = ¥72
合計$200$32(約 6.3 倍安い)¥192(約 $27)

プロンプトキャッシュで差はさらに広がる(Qwen のキャッシュヒット入力 ¥1.5/M、Fable 5 のキャッシュ読み $1/M)。Fable 5 にはトークン以外の強みが 1 つある:2026 年 7 月 20 日以降、Claude Max と Team Premium の週次上限の最大 50% に恒久的に含まれ、サブスクユーザーは API 価格を払わない場合がある。従量課金なら、決める前に当サイトのコスト計算ツールで実数を計算してほしい。

判断マトリクス

  • 中国本土で開発し、直接アクセス・人民元請求・輸出管理リスクなしの最前線モデルが要るQwen 3.8 Max。 Fable 5 は米輸出管理で全世界 19 日間停止され、Anthropic の API は海外提供——データ越境の問題は価格で解決できない。
  • 予算が限られ、作業は日常のコーディング・数学・マルチモーダルQwen 3.8 Max。定価は Fable 5 の約 5 分の 1。最難の 20% 向けに昇格経路を残すこと。
  • 自前ホスト・監査可能な推論が必要ウェイト公開後に判断。 2026-08-04 時点で日付とライセンスは未確認。公式チャネルでの公開前に依存しないこと。
  • 最難のエージェント型コーディング、長期自律タスク、Claude Code / Model Fusion ベースの開発Fable 5。保持義務なしの Anthropic 系が必要なら Claude Opus 5($5/$25。詳細は Fable 5 vs Opus 5)。
  • データを特定管轄外に出せない → 価格ではなくデータ所在で判断:Fable 5 は ZDR 除外の強制 30 日保持。Alibaba Cloud 国内ノードは処理を中国国内に置くが中国のデータ規則に縛られる。契約前にリージョンと条件を確認。
  • 迷っている → 移植可能なプロンプトを 1 本作り、両モデルで少量実測し、Fable 5 代替ガイドで全選択肢を比較してから決める。

正直な結論

Qwen 3.8 Max は、価格・規模・エージェント型への野心で今年初めて Fable 5 の領域に実際に踏み込んだ挑戦者であり、輸出管理やデータ越境の手間なしで中国本土のチームが採用できる初の選択肢だ。ただし「踏み込んだ」には但し書きが要る:モデルカードなしの発表、ベンダー報告のみの数字、日付もライセンスも未定のオープンウェイト。Fable 5 の検証済み SWE-Bench Pro 80.3% と実績あるエージェント型ランタイムは、依然としてこの分野を測る物差しだ。両方で小規模に試し、「タスクを解決する 1 件あたりの実コスト」——発表資料ではなく——で判断してほしい。

独立分析——すべての選択肢は当サイトの Fable 5 代替ガイド で比較できます。

関連記事