2026 年夏の中国製フロンティアモデル動向を追い、Qwen3.8-Max を本番 API に入れるべきか、オープン重みを待つべきか、Kimi K3 や DeepSeek V4 を優先すべきかを判断したい開発者向けに、本稿はタイムライン・主要スペック・横並び比較・透明性の論点の 4 軸で整理します。結論の要点:8 月 3 日 GA 時点では重みは未公開で、ベンチマークはすべて Alibaba 自社ハーネス由来です。
タイムライン:出荷されたものと、まだ出ていないもの
- 7 月 16 日:Moonshot AI が Kimi K3(2.8T パラメータ MoE)を公開。
- 7 月 19 日:Qwen3.8-Max プレビュー、正式価格の 10%、活性パラメータ未開示。
- 7 月 27 日:Kimi K3 が Hugging Face でオープン重みを公開。
- 7 月 31 日:DeepSeek V4-Flash、パラメータ増なしで V4-Pro 超えのエージェント・コードベンチ。
- 8 月 3 日:Qwen3.8-Max GA、「千問办公」Agent 同時投入。阿里株は当日約 7% 上昇。
- 来週(8 月 10 日前後想定):Qwen3.8-Max と Qwen3.8-27B の重み公開予定、現時点でリポジトリなし。
Arena Text Arena(8 月 1 日スナップショット)で #5・1496 点(Preliminary)。上位 8 件中唯一の非 Anthropic モデルですが、スコアはすべてベンダー実行です。
Alibaba が公表した数値
| 項目 | Qwen3.8-Max |
|---|---|
| 総 / 活性パラメータ | 2.4T / 95B |
| アーキテクチャ | スパース MoE + ハイブリッド注意 |
| コンテキスト | 100 万トークン |
| API 価格 | 入力 $2 / 出力 $6(100 万トークンあたり) |
| Arena テキスト | #5、1496 点(Preliminary) |
| オープン重み | 「来週」予定、未公開 |
2.4 兆パラメータの意味:MoE と長期エージェント
総容量 2.4T に対しトークンあたり活性は 95B のみ。推論コストは活性数に追従するため、Claude Opus 5($5/$25)や Fable 5($10/$50)より低い $2/$6 が可能です。reasoning_effort は low / medium / xhigh の 3 段階で、enable_thinking または Anthropic 互換の reasoning.effort から指定できます。
- API 互換(OpenAI / Anthropic)を確認する。
- タスクに応じて reasoning_effort を選びトークンコストを制御する。
- ローカル運用は Qwen3.8-27B のオープン重みを待つ。
- 自社ワークロードで A/B テストを行う。
- Hugging Face のリポジトリとライセンスを確認する。
- 既公開の Kimi K3・DeepSeek V4 をベースラインとする。
Qwen3.8-Max vs Kimi K3 vs DeepSeek V4 vs Claude
| モデル | 価格(入/出) | オープン重み | 独立ベンチ |
|---|---|---|---|
| Qwen3.8-Max | $2 / $6 | 未公開(予定) | なし |
| Kimi K3 | $3 / $15 | 7 月 27 日公開済 | Artificial Analysis ≈ 57.11 |
| DeepSeek V4-Flash | 未完全公開 | 公開済 | V4-Pro 超え 9 ベンチ |
| Claude Fable 5 | $10 / $50 | クローズド | Arena テキスト #1 |
独立ブラインドテスト(269 ファイルの設計タスク)では Kimi K3 83 点、Qwen3.8-Max プレビュー 80 点で同格です。API 価格の背景は GPT-5.6 値下げの解説 も参照してください。
検証可能な技術情報と出典
- MoE 効率:2.4T 総 / 95B 活性(Alibaba 発表資料)。
- Arena:8 月 1 日スナップショット #5、Preliminary 表記(Arena.ai)。
- 独立盲検:83 vs 80(第三者評価、Alibaba 非実行)。
「オープンソース」ラベルの問題
- GA 当日に Open-Source 表示、重みリポジトリは未公開。
- ベンチマークはすべてベンダー実行(RecreationBench 等の自社ベンチ含む)。
- プレビュー期は活性パラメータ・モデルカード未開示。
FAQ
今すぐオープンソースか?
いいえ。API は利用可能ですが、Hugging Face / ModelScope に重みは未掲載です。「来週」公開予定で確定日はありません。
Kimi K3 との差は?
独立比較では 83 対 80 で互角。Kimi K3 は重み公開済み、Qwen3.8-Max は API 価格とマルチモーダルが強みです。
重みの公開と第三者再現が揃うまでは、Qwen3.8-27B などのローカル検証には専用の Apple Silicon 実機が再現性の面で有利な場合があります。VMSPIN の日単位クラウド Mac mini は MDM 自動プロビジョニングと SSH + VNC デュアルアクセスに対応。Mac mini M4 レンタル解説 と 料金ページ もあわせてご確認ください。