AI News HubLIVE
站内改写3 分钟阅读

Kimi K3 为何引起华盛顿关注

月之暗面AI发布Kimi K3,在Frontend Code Arena基准测试中夺冠,引发美国AI监管辩论。尽管在前端编码方面表现强劲,但整体仍落后于Claude Fable 5。该发布加剧了AI监管和开源模型的政策争论,对NVIDIA和Anthropic等股票产生影响。

来源Hacker News AI作者: Kavon2992

北京月之暗面AI于周四发布了Kimi K3,这是一个拥有2.8万亿参数的开源模型,立即在Arena的Frontend Code排行榜上夺得第一名。到周五早上,白宫技术顾问David Sacks就在X上声称,这证明了美国正因AI监管而“作茧自缚”,而中国却在不断推出新产品。

基准测试结果真实可靠,但只是整体情况的一部分。Kimi K3在Arena社区投票的Frontend Code排行榜上获得1679分,领先于Anthropic的Claude Fable 5(1631分)和OpenAI的GPT-5.6 Sol(1618分)。与Fable 5的48分差距,比Fable 5与GPT-5.6 Sol之间的差距还要大。这是基于483895次盲人投票的真实结果,而非供应商操控的图表。然而,在前端编码之外,月之暗面自家的14项基准测试套件中,Fable 5仍以8比6领先。Fable 5在最具挑战性的软件工程评估中保持优势:FrontierSWE领先5.4分,DeepSWE领先2.5分。K3则在长任务场景中胜出,如Terminal Bench、SWE Marathon、BrowseComp和前端生成。月之暗面自己也承认,K3的“整体用户体验仍落后于Claude Fable 5和GPT-5.6 Sol”,这是整个发布中最能建立信任的表述。

K3的规格仍然令人瞩目。它是世界上首个开放的3万亿参数级模型,采用稀疏混合专家架构,每个token仅激活896个专家中的16个。它拥有100万token的上下文窗口、原生视觉能力,API定价为每百万输入token 3美元、每百万输出token 15美元,与Anthropic的Claude Sonnet 5标准费率一致。完整权重将于7月27日发布。

政策层面,Sacks在周五上午发帖称,K3的结果“令人担忧”,美国正因“禁止新建数据中心、堆积州级法规、推动建立新联邦机构预先审批前沿模型”而输掉AI竞赛。他口中的“许可创新”是本届政府的方针:让私营部门建设,有针对性地应对风险,不要设置北京会忽视的审批门槛。这并非Sacks的新论点,他已与Anthropic争论数周,指责该公司鼓励各州实施更严格的AI护栏。Anthropic大约五周前提出了对前沿模型发布进行法定政府预审批的提案。K3的发布时间提供了完美弹药:当华盛顿还在辩论审批框架时,一家中国实验室已经推出了与Fable 5在多项基准上竞争的模型,并计划开源权重。

特朗普政府一贯采取放松监管的立场。它于2025年5月撤销了拜登的AI扩散规则,批准了英伟达H200对华出口并加征25%关税。6月30日,商务部长Howard Lutnick完全解除了曾短暂限制Anthropic的Fable 5和Mythos 5模型的出口管制,条件是Anthropic同意与政府协调安全协议。在这届政府领导下,不太可能出现对华AI模型的新限制。更可能的动向是相反的:路透社7月7日报道称,北京正考虑限制海外访问中国最先进的AI模型,并已与阿里巴巴、字节跳动和智谱会面,讨论限制外国访问。

股市方面,英伟达周五收于203.05美元,下跌2.1%,半导体板块因K3消息普遍抛售。这种膝跳反应——认为有竞争力的中国模型降低了美国AI领导力的价值——忽略了计算数学。一个拥有2.8万亿参数和896个专家的模型需要巨大的GPU容量来训练和服务。每一个前沿模型,无论是美国的还是中国的,都运行在GPU上。如果说有什么影响,K3验证了AI需求是全球性的且不断增长,这在结构上对英伟达的总可寻址市场有利。

Anthropic已于6月1日秘密提交IPO申请,据报道目标估值接近1万亿美元。K3在一个可见的公共基准上以低40%的成本击败Fable 5,并采用开放权重,这对IPO叙事是一个具有竞争力的信号。Fable 5仍然是整体更强的模型,且Anthropic的出口控制风波已有利解决。但开放权重趋势,加上Sacks对Anthropic监管模式的政治攻击,造成了一个月前不存在的逆风。

超大规模云服务商随大市下跌:微软收于394.32美元,跌1.7%;Alphabet收于347.06美元,跌2.1%。长期来看略偏正面。开放权重前沿模型意味着云提供商可以更低成本地托管K3供企业客户使用。更多模型竞争改善了推理利润率。而Sacks反对数据中心限制的立场直接支持了超大规模云服务商的资本支出计划。

K3的权重将于7月27日公开。一旦任何公司或政府都能下载并运行一个前沿模型,政策讨论将从“是否应该限制模型”转向“能否限制模型”。后一个问题的答案越来越倾向于否。开放权重的精灵不会回到瓶子里,这一现实,而非任何单一基准,将塑造下一轮AI政策。