没人愿意承认的真相:无论中国与否,开放模型现在已具备竞争力
Moonshot AI的Kimi K3作为2.8万亿参数的开源模型,在基准测试中与美国顶级模型匹敌,引发对AI竞争和国家安全的新讨论。文章指出,美国限制中国模型可能适得其反,减少竞争最终损害企业和消费者。
每隔半年左右,中国模型就会引发一轮恐慌,质疑美国在AI领域的主导地位。Moonshot AI的Kimi K3是最新的例子。回想去年初DeepSeek R1如何撼动市场?按照类似的模式,Moonshot的最新模型除了基准测试成绩外,本身并不那么引人注目,而且它接近三万亿的参数规模超出了大多数企业的能力范围。
对于OpenAI和Anthropic这样的公司来说,这项技术的吸引力远不如其国家来源。中国模型可以被当作国家安全威胁来宣扬——Anthropic的恐惧贩卖者兼首席执行官Dario Amodei过去曾这样说过。上个月,这位高管指责阿里巴巴(另一家多产的中国AI模型开发商)通过一种称为蒸馏的过程使用Claude来改进其Qwen系列模型。
这些指控出自一个其公司刚刚同意支付15亿美元以解决关于盗用数百万本盗版书籍训练Claude的诉讼的人之口,未免过于讽刺。五十步笑百步?
尽管如此,Moonshot的Kimi K3引发的焦虑确实感觉不同。模型规模是一个因素。作为拥有2.8万亿参数的开源模型,Kimi K3是迄今为止最大的开放权重模型。模型的体量无疑强化了K3是前沿模型的观点。模型有许多有趣的架构变化,但据我们所知,它们与当前流传的反华AI言论毫无关系。
但让我们谈谈基准测试!我们之前已经在Z.AI的GLM系列、MiniMax M系列、Qwen以及当然还有DeepSeek上经历过这种情况:新模型发布时伴随着显示其与OpenAI、Anthropic或Google最佳模型不相上下的基准测试图表。
Kimi K3正沿着这条老路走。上周,Moonshot发布了一篇冗长的博客文章,包含大量展示其新模型的基准测试图表和演示,并不出意料地讲述了同样的故事:尽管美国限制美国制造的加速器对华出口,但中国模型厂商并不像Altman和Amodei希望的那样落后。
变化的是美国政府对前沿模型的态度。GPT-5.6显然引起了足够的担忧,以至于美国政府推迟了其发布,而Claude Fable 5在发布后不久因官员调查安全问题而下线。正如我们后来报道的,隐藏在Fable床下的怪物并非某种洛夫克拉夫特式的恐怖,甚至未达到迪士尼反派的程度。据一位研究人员称,那只是突然意识到生成式AI模型已经达到了这样的能力水平:用户可以输入“修复这段代码”,它们就会照做。
然而,这次短暂的扰动可能成了Anthropic的免费营销,该公司一直宣扬开放模型固有危险的观点。从这个角度看,围绕Fable 5和GPT-5.6延迟的戏剧性事件成了弹药。如果美国顶级模型足以让美国政府担忧,那为什么Kimi K3不能呢?毕竟,OpenAI和Anthropic是美国公司,可以服从特朗普政府的意愿。但一个源于中国的开放权重前沿模型呢?没那么简单。
特朗普政府显然已经注意到这一点。据报道,白宫官员听到要求限制中国模型的呼声,但尚未采取正式行动。无论这次会发生什么,新报告显示美国和中国将于今年晚些时候会面,讨论各自国家AI事业日益增长的威胁。在AI军备竞赛中,AI峰会不可避免。
美国模型公司肯定会从限制中国模型中受益。以国家安全为借口,这些限制将切断中国AI开发者向美国实验室提供最强竞争的机会。但竞争减少必然意味着企业和消费者被坑。
美国尚未像中国开发者那样大规模追求大型开放权重模型。Thinking Machines Lab新宣布的Inkling模型,参数接近一万亿,是美国开放权重模型中最好的。接下来最近的是Nvidia的Nemotron 3 Ultra,拥有5500亿参数。
谁知道白宫是否会真的上当并给予Amodei他所期望的本能反应?但如果特朗普政府不希望美国公司(特别是那些为政府机构服务的公司)使用中国模型,答案不是减少竞争,而是增加竞争。®