AI News HubLIVE
站内改写2 分钟阅读

阿里巴巴预览Qwen3.8-Max:2.4万亿参数多模态模型,紧随Moonshot的Kimi K3开源发布之后

阿里巴巴Qwen团队预览了Qwen3.8-Max-Preview,一个2.4万亿参数的多模态MoE模型,号称“仅次于Fable 5”。该预览已在Token Plan、Qoder和QoderWork上以标准定价的10%提供。但尚未提供任何基准测试表、模型卡、许可证、每token价格或激活参数数量。本文区分了阿里巴巴确认的内容和仅声称的内容。

来源MarkTechPost作者: Asif Razzaq

2026年7月19日,阿里巴巴的Qwen团队在WAIC上海世界人工智能大会上预览了Qwen3.8-Max-Preview,这是Qwen系列的下一代旗舰模型。研究团队称其为2.4万亿参数模型,“在基准测试的系统中仅次于Fable 5”。预览版现已上线,但基准测试表、模型卡和许可证尚未公布。

此次发布的时间点恰好是在Moonshot AI发布Kimi K3(一个2.8万亿参数的开源权重模型)两天之后。这一时机本身与模型本身同样值得关注。

本文将区分阿里巴巴确认的内容与仅声称的内容。以下所有性能数据均带有这一限制条件。

Qwen宣布了什么

Qwen账号发布称Qwen3.8即将发布并很快开源权重。它称该模型是“目前最强大的模型之一,可与领先的前沿系统相媲美”。预览构建是真实可购买的,通过阿里巴巴的Token Plan订阅提供,且预览价为标准定价的10%。

Qwen开发者Shuai Bai补充了技术细节。他将Qwen3.8描述为该团队首个超过1万亿参数的多模态模型,能够处理文本、图像、视频和文档。阿里巴巴团队表示,该模型在编码、全栈开发、数据分析和办公工作流方面应优于Qwen3.7-Max。

确认 vs 声称

  • 参数规模:2.4万亿参数是阿里巴巴自己的数字,尚无模型卡或规格确认。
  • 性能排名:“仅次于Fable 5”的说法尚无基准测试表支撑,仅基于内部评估。
  • 开源权重:承诺“很快”但无具体日期、许可证或Hugging Face仓库。阿里巴巴前两个Max旗舰模型均未开源。
  • 激活参数:每token激活参数数量未公布——这是决定稀疏MoE模型真实服务成本的关键数字。

已确认的内容:预览版已上线并可购买;稀疏MoE架构,多模态;兼容OpenAI和Anthropic协议,现有编码智能体可直接调用。

2.4万亿参数的问题

总参数数量并不等同于可用计算量。这一区别比主数字更重要。Qwen自身的历史证明了这一点:Qwen3-235B-A22B总参数2350亿,但每token仅激活220亿;Qwen3-30B-A3B每token激活约30亿。两者都是稀疏MoE设计,Qwen的Max层级也是如此。

对于Qwen3.8,激活参数数量是没人知道的数字。没有它,2.4万亿参数对服务成本几乎没有意义。据Startup Fortune计算,一个2.4万亿参数的4位精度模型需要约1.2TB的权重内存,而单个Nvidia H200仅141GB,即使八张卡也会面临尴尬的数学问题。

因此,实际问题不在于排行榜位置,而在于阿里巴巴是否会提供更小的激活参数变体、好的量化检查点或蒸馏版。

开发者反应

关于Qwen3.8预览版的社区反应呈现可预见的分化:对另一个开源前沿模型的热情与对未验证基准测试的疲劳感并存。在Hacker News上,主流观点认为中国实验室之间的开源竞争对所有人都有利。评论者讨论了动机,并将其时机解读为对Kimi K3的直接回应。少数人质疑“仅次于Fable 5”的说法,并称Qwen相比竞争对手是基准测试专家。

在Reddit的r/LocalLLaMA上,讨论更为实际:2.4万亿参数的服务计算占据主导,同时希望有一个更小或蒸馏的变体可以在工作站上运行。在X平台上,该公告成为趋势,大型账号(包括kimmonismus)放大了开源的消息。

迁移前的注意事项

不要仅凭预览就迁移生产工作负载。在迁移前需要等待以下五件事:官方Qwen博客文章附有基准测试表;激活参数数量;Hugging Face仓库附有真实许可证文件;公布的API定价;来自Artificial Analysis或LMArena等渠道的独立评估。在此之前,请通过官方控制台在您自己的工作负载上测试Qwen3.8-Max-Preview,并将生产流量保持在原有位置。您自己的评估胜过任何发布数字。