【AINews】开源权重之争:众说纷纭,唯有Kimi K3今日发布
AI开源权重的辩论激烈,但只有Moonshot AI的Kimi K3模型真正发布。K3在多项评测中表现优异,并附带全套基础设施开源。NVIDIA发起开放安全AI联盟,Anthropic澄清其开源立场。同时,模型评测和代理可靠性成为关注焦点。
本周AI界的焦点集中在“开源权重”的辩论上,尽管各方言论纷飞,但真正落地的只有Moonshot AI的Kimi K3模型。K3是一个2.8T参数的MoE模型,拥有104B活跃参数、896个专家(每token激活16个)、1M token上下文窗口,并原生支持视觉理解。Moonshot还开源了FlashKDA(Delta注意力核)、MoonEP(MoE通信库)和AgentENV(分布式代理环境基础设施),使其不仅仅是一个模型发布,更是一套完整的训练和服务方案。
K3的技术报告显示,相比K2,其扩展效率提升了约2.5倍,架构和训练选择围绕极端规模下的数值稳定性展开。报告中提及使用了MXFP4权重和MXFP8激活,视觉编码器从头联合训练以确保稳定性,并重点关注了MoE路由和信号传播问题。不过,报告未披露总训练token数,这一点被多位研究者指出。
在许可方面,K3采用“开源权重”而非完全开源的MIT/Apache协议。模型广泛可用,但年收入超过2000万美元的大型托管提供商需要单独协议,月活超1亿或月收入超2000万美元的产品需在UI中显示“Kimi K3”。这标志着前沿“开源”可能趋于源码可用/开源权重加上商业限制的折中方案。
K3发布首日即可通过vLLM、Baseten、Modal、Fireworks等多个平台访问,覆盖范围之广表明开源权重前沿模型的发布已成为供应链事件。
与此同时,NVIDIA正式发起开放安全AI联盟(Open Secure AI Alliance)。黄仁勋强调,攻击者已拥有强大AI,防御者需要生态系统支持,包括开源和闭源前沿模型以及共享工具和研究。联盟成员包括Hugging Face、LangChain、Nous Research等。其论点并非“开源自动更安全”,而是防御能力和可审计性需要开放访问模型、工具和迹线。
Anthropic也明确了其开源权重立场:它从未主张禁止开源权重,而是支持对中国的芯片管控、反工业规模蒸馏措施,以及对足够强大模型(无论开源还是闭源)的强制性安全测试。各方反应不一,有人认为这是合理的澄清,也有人认为其旨在减缓前沿扩散。
政策压力也在加剧。有报道称美国政府可能要求前沿系统在发布前30天提交给NSA和CAISI等机构进行评估,开源与闭源的处理方式仍未确定。前沿模型发布正成为治理接口,而不仅是产品发布。
在评测方面,K3表现出色:在Agent Arena中,Kimi K3 Max在开源权重模型中排名第一,净提升9.75%;在Frontend Code Arena中,它甚至超越了所有模型。Cognition表示K3是首个“接近前沿性能”的开源模型。然而,Claude Opus 5虽然在线评测中表现突出,但在实际使用中暴露出过度复杂、行为不稳定等问题,凸显了公开评测与生产实用性的差距。
新的评测工作关注顺序退化和隐藏回归。EvoCode评估了代理在持续容器中遵循演化需求的能力,而另一项研究揭示了“回归税”:技能提升带来了收益,但也破坏了之前已解决的许多任务。多模块RL系统还出现了“角色漂移”问题,端到端RL可能导致模块悄然偏离原本职责。
基础设施方面,微软发布了Mage-VL 4B,一个面向实时事件理解的流式VLM;NVIDIA推出了Molt,一个PyTorch原生代理RL框架,设计简洁到人类和AI编码助手都能端到端推理。AMD发布了Instella-MoE,其首个完全开源MoE语言模型,包含从预训练到RL的完整检查点、配置、数据混合和代码。
Cohere和LangChain等开发者工具厂商继续转向“拥有控制权”的理念,强调企业应拥有工具、提示、上下文和记忆,而不仅仅是租用模型访问。
总的来说,本周AI新闻以开源权重为中心,Kimi K3的发布是最大亮点,而围绕开放安全、评测和政策监管的讨论也在持续发酵。