沒人願意承認的真相:無論中國與否,開放模型現在已具備競爭力
Moonshot AI的Kimi K3作為2.8萬億參數的開源模型,在基準測試中與美國頂級模型匹敵,引發對AI競爭和國家安全的新討論。文章指出,美國限制中國模型可能適得其反,減少競爭最終損害企業和消費者。
每隔半年左右,中國模型就會引發一輪恐慌,質疑美國在AI領域的主導地位。Moonshot AI的Kimi K3是最新的例子。回想去年初DeepSeek R1如何撼動市場?按照類似的模式,Moonshot的最新模型除了基準測試成績外,本身並不那麼引人注目,而且它接近三萬億的參數規模超出了大多數企業的能力範圍。
對於OpenAI和Anthropic這樣的公司來説,這項技術的吸引力遠不如其國家來源。中國模型可以被當作國家安全威脅來宣揚——Anthropic的恐懼販賣者兼首席執行官Dario Amodei過去曾這樣説過。上個月,這位高管指責阿里巴巴(另一家多產的中國AI模型開發商)通過一種稱為蒸餾的過程使用Claude來改進其Qwen系列模型。
這些指控出自一個其公司剛剛同意支付15億美元以解決關於盜用數百萬本盜版書籍訓練Claude的訴訟的人之口,未免過於諷刺。五十步笑百步?
儘管如此,Moonshot的Kimi K3引發的焦慮確實感覺不同。模型規模是一個因素。作為擁有2.8萬億參數的開源模型,Kimi K3是迄今為止最大的開放權重模型。模型的體量無疑強化了K3是前沿模型的觀點。模型有許多有趣的架構變化,但據我們所知,它們與當前流傳的反華AI言論毫無關係。
但讓我們談談基準測試!我們之前已經在Z.AI的GLM系列、MiniMax M系列、Qwen以及當然還有DeepSeek上經歷過這種情況:新模型發佈時伴隨着顯示其與OpenAI、Anthropic或Google最佳模型不相上下的基準測試圖表。
Kimi K3正沿着這條老路走。上週,Moonshot發佈了一篇冗長的博客文章,包含大量展示其新模型的基準測試圖表和演示,並不出意料地講述了同樣的故事:儘管美國限制美國製造的加速器對華出口,但中國模型廠商並不像Altman和Amodei希望的那樣落後。
變化的是美國政府對前沿模型的態度。GPT-5.6顯然引起了足夠的擔憂,以至於美國政府推遲了其發佈,而Claude Fable 5在發佈後不久因官員調查安全問題而下線。正如我們後來報道的,隱藏在Fable牀下的怪物並非某種洛夫克拉夫特式的恐怖,甚至未達到迪士尼反派的程度。據一位研究人員稱,那只是突然意識到生成式AI模型已經達到了這樣的能力水平:用户可以輸入“修復這段代碼”,它們就會照做。
然而,這次短暫的擾動可能成了Anthropic的免費營銷,該公司一直宣揚開放模型固有危險的觀點。從這個角度看,圍繞Fable 5和GPT-5.6延遲的戲劇性事件成了彈藥。如果美國頂級模型足以讓美國政府擔憂,那為什麼Kimi K3不能呢?畢竟,OpenAI和Anthropic是美國公司,可以服從特朗普政府的意願。但一個源於中國的開放權重前沿模型呢?沒那麼簡單。
特朗普政府顯然已經注意到這一點。據報道,白宮官員聽到要求限制中國模型的呼聲,但尚未採取正式行動。無論這次會發生什麼,新報告顯示美國和中國將於今年晚些時候會面,討論各自國家AI事業日益增長的威脅。在AI軍備競賽中,AI峯會不可避免。
美國模型公司肯定會從限制中國模型中受益。以國家安全為藉口,這些限制將切斷中國AI開發者向美國實驗室提供最強競爭的機會。但競爭減少必然意味着企業和消費者被坑。
美國尚未像中國開發者那樣大規模追求大型開放權重模型。Thinking Machines Lab新宣佈的Inkling模型,參數接近一萬億,是美國開放權重模型中最好的。接下來最近的是Nvidia的Nemotron 3 Ultra,擁有5500億參數。
誰知道白宮是否會真的上當並給予Amodei他所期望的本能反應?但如果特朗普政府不希望美國公司(特別是那些為政府機構服務的公司)使用中國模型,答案不是減少競爭,而是增加競爭。®