2026 年夏の中国製フロンティアモデル動向を追い、Qwen3.8-Max を本番 API に入れるべきか、オープン重みを待つべきか、Kimi K3 や DeepSeek V4 を優先すべきかを判断したい開発者向けに、本稿はタイムライン・主要スペック・横並び比較・透明性の論点の 4 軸で整理します。結論の要点:8 月 3 日 GA 時点では重みは未公開で、ベンチマークはすべて Alibaba 自社ハーネス由来です。

タイムライン:出荷されたものと、まだ出ていないもの

  • 7 月 16 日:Moonshot AI が Kimi K3(2.8T パラメータ MoE)を公開。
  • 7 月 19 日:Qwen3.8-Max プレビュー、正式価格の 10%、活性パラメータ未開示。
  • 7 月 27 日:Kimi K3 が Hugging Face でオープン重みを公開。
  • 7 月 31 日:DeepSeek V4-Flash、パラメータ増なしで V4-Pro 超えのエージェント・コードベンチ。
  • 8 月 3 日:Qwen3.8-Max GA、「千問办公」Agent 同時投入。阿里株は当日約 7% 上昇。
  • 来週(8 月 10 日前後想定):Qwen3.8-Max と Qwen3.8-27B の重み公開予定、現時点でリポジトリなし。

Arena Text Arena(8 月 1 日スナップショット)で #5・1496 点(Preliminary)。上位 8 件中唯一の非 Anthropic モデルですが、スコアはすべてベンダー実行です。

Alibaba が公表した数値

項目Qwen3.8-Max
総 / 活性パラメータ2.4T / 95B
アーキテクチャスパース MoE + ハイブリッド注意
コンテキスト100 万トークン
API 価格入力 $2 / 出力 $6(100 万トークンあたり)
Arena テキスト#5、1496 点(Preliminary)
オープン重み「来週」予定、未公開

2.4 兆パラメータの意味:MoE と長期エージェント

総容量 2.4T に対しトークンあたり活性は 95B のみ。推論コストは活性数に追従するため、Claude Opus 5($5/$25)や Fable 5($10/$50)より低い $2/$6 が可能です。reasoning_effort は low / medium / xhigh の 3 段階で、enable_thinking または Anthropic 互換の reasoning.effort から指定できます。

  1. API 互換(OpenAI / Anthropic)を確認する。
  2. タスクに応じて reasoning_effort を選びトークンコストを制御する。
  3. ローカル運用は Qwen3.8-27B のオープン重みを待つ。
  4. 自社ワークロードで A/B テストを行う。
  5. Hugging Face のリポジトリとライセンスを確認する。
  6. 既公開の Kimi K3・DeepSeek V4 をベースラインとする。

Qwen3.8-Max vs Kimi K3 vs DeepSeek V4 vs Claude

モデル価格(入/出)オープン重み独立ベンチ
Qwen3.8-Max$2 / $6未公開(予定)なし
Kimi K3$3 / $157 月 27 日公開済Artificial Analysis ≈ 57.11
DeepSeek V4-Flash未完全公開公開済V4-Pro 超え 9 ベンチ
Claude Fable 5$10 / $50クローズドArena テキスト #1

独立ブラインドテスト(269 ファイルの設計タスク)では Kimi K3 83 点、Qwen3.8-Max プレビュー 80 点で同格です。API 価格の背景は GPT-5.6 値下げの解説 も参照してください。

検証可能な技術情報と出典

  • MoE 効率:2.4T 総 / 95B 活性(Alibaba 発表資料)。
  • Arena:8 月 1 日スナップショット #5、Preliminary 表記(Arena.ai)。
  • 独立盲検:83 vs 80(第三者評価、Alibaba 非実行)。

Arena.ai 公開リーダーボード

Alibaba Cloud 公式発表・料金

「オープンソース」ラベルの問題

  1. GA 当日に Open-Source 表示、重みリポジトリは未公開。
  2. ベンチマークはすべてベンダー実行(RecreationBench 等の自社ベンチ含む)。
  3. プレビュー期は活性パラメータ・モデルカード未開示。

FAQ

今すぐオープンソースか?

いいえ。API は利用可能ですが、Hugging Face / ModelScope に重みは未掲載です。「来週」公開予定で確定日はありません。

Kimi K3 との差は?

独立比較では 83 対 80 で互角。Kimi K3 は重み公開済み、Qwen3.8-Max は API 価格とマルチモーダルが強みです。

重みの公開と第三者再現が揃うまでは、Qwen3.8-27B などのローカル検証には専用の Apple Silicon 実機が再現性の面で有利な場合があります。VMSPIN の日単位クラウド Mac mini は MDM 自動プロビジョニングと SSH + VNC デュアルアクセスに対応。Mac mini M4 レンタル解説料金ページ もあわせてご確認ください。