AI News HubLIVE
サイト内リライト3 分で読了

Alibaba、2.4兆パラメータのマルチモーダルモデルQwen3.8-Maxをプレビュー、MoonshotのKimi K3オープンウェイト公開から数日後

AlibabaのQwenチームは、2.4兆パラメータのマルチモーダルMoEモデルQwen3.8-Max-Previewをプレビューし、「Fable 5に次ぐ」と称しています。プレビューはToken Plan、Qoder、QoderWorkで標準価格の10%で提供されています。ベンチマーク表、モデルカード、ライセンス、トークンあたりの価格、アクティブパラメータ数はまだ公開されていません。本記事では、Alibabaが確認した情報と主張のみの情報を区別します。

ソースMarkTechPost著者: Asif Razzaq

2026年7月19日、AlibabaのQwenチームは上海で開催された世界AI会議(WAIC)でQwen3.8-Max-Previewをプレビューしました。これはQwenファミリーの次期フラッグシップモデルで、研究チームは2.4兆パラメータのモデルであり、「ベンチマークしたシステムの中でFable 5に次ぐ」と説明しています。プレビュー版は現在利用可能ですが、ベンチマーク表、モデルカード、ライセンスはまだ公開されていません。

この発表は、Moonshot AIが2.8兆パラメータのオープンウェイトモデルKimi K3をリリースした2日後に行われました。このタイミングはモデルそのものと同じくらい重要です。

本記事では、Alibabaが確認した情報と主張のみの情報を区別します。以下の性能数値はすべて、その留保付きです。

Qwenが発表した内容

Qwenアカウントは、Qwen3.8が近日中にリリースされ、オープンウェイトになる予定であると投稿しました。また、このモデルを「現在利用可能な最も強力なモデルの1つであり、最先端のシステムに匹敵する」と述べています。プレビュービルドは実際に購入可能で、AlibabaのToken Planサブスクリプションを通じて提供されています。プレビュー価格は標準価格の10%です。

Qwen開発者のShuai Baiは技術的な詳細を追加しました。彼はQwen3.8を、チーム初の1兆パラメータを超えるマルチモーダルモデルであり、テキスト、画像、ビデオ、ドキュメントを処理できると説明しました。Alibabaチームは、このモデルがコーディング、フルスタック開発、データ分析、オフィスワークフローにおいてQwen3.7-Maxを上回るはずだと述べています。

確認済み vs 主張

  • パラメータ規模: 2.4兆パラメータはAlibaba自身の数値であり、モデルカードや仕様による確認はありません。
  • 性能ランキング: 「Fable 5に次ぐ」という主張は、内部評価に基づくものであり、公開されたベンチマーク表はありません。
  • オープンウェイト: 「近いうちに」と約束されていますが、日付もライセンスもHugging Faceリポジトリもありません。Alibabaの過去2つのMaxフラッグシップはクローズドでした。
  • アクティブパラメータ: トークンあたりのアクティブパラメータ数は非公開です。これはスパースMoEモデルの実際のサービスコストを決定する重要な数値です。

確認済み: プレビュー版は公開され購入可能。スパースMoEアーキテクチャ、マルチモーダル。OpenAIおよびAnthropicプロトコルと互換性があり、既存のコーディングエージェントはそのままQwen3.8を指すことができます。

2.4兆パラメータの問題

総パラメータ数は使用可能な計算量と同じではありません。この違いは主要な数値よりも重要です。Qwen自身の歴史がその点を証明しています。Qwen3-235B-A22Bは総パラメータ2350億ですが、トークンあたり220億しか活性化しません。Qwen3-30B-A3Bは約30億を活性化します。どちらもスパースMoE設計であり、QwenのMax層も同様です。

Qwen3.8では、アクティブパラメータ数は誰も知らない数字です。それがなければ、2.4兆パラメータという数字はサービスコストについてほとんど語りません。Startup Fortuneの計算によると、2.4兆パラメータの4ビット精度モデルにはウェイトだけで約1.2TBのメモリが必要であり、単一のNvidia H200は141GBしか搭載していません。8枚のカードでも厄介な計算になります。

したがって、実用的な問題はリーダーボードの順位ではなく、Alibabaがより小さいアクティブパラメータのバリアント、優れた量子化チェックポイント、または蒸留版を提供するかどうかです。

開発者の反応

Qwen3.8プレビューに関するコミュニティの反応は、予想通りに分かれました。別のオープンウェイトフロンティアモデルへの熱意と、未検証のベンチマークへの疲労が混在しています。Hacker Newsでは、中国の研究所間のオープンウェイト競争はすべての人に利益をもたらすという見解が支配的でした。コメンテーターは動機を議論し、タイミングをKimi K3への直接的な応答と見なしました。少数派は「Fable 5に次ぐ」というフレーミングに疑問を呈し、Qwenを競合他社に比べてベンチマークの専門家と呼びました。

Redditのr/LocalLLaMAでは、議論は実用的でした。2.4Tのサービス計算が支配的であり、ワークステーションでロードできるより小さいまたは蒸留されたバリアントへの期待がありました。Xでは、この発表はトレンド入りし、kimmonismusを含む大規模アカウントがオープンウェイトのメッセージを増幅しました。

移行前の注意事項

ティーザーだけで本番ワークロードを移行しないでください。移行前に以下の5つが揃うのを待つ必要があります。公式Qwenブログ投稿によるベンチマーク表、アクティブパラメータ数、実際のライセンスファイル付きのHugging Faceリポジトリ、公開されたAPI価格、Artificial AnalysisやLMArenaなどのアウトレットによる独立した評価。それまでは、公式コンソールを通じてQwen3.8-Max-Previewを自身のワークロードでテストし、本番トラフィックは既存の場所に維持してください。自身の評価がどんな発表数字にも勝ります。