【AINews】開源權重之爭:眾說紛紜,唯有Kimi K3今日釋出
AI開源權重的辯論激烈,但只有Moonshot AI的Kimi K3模型真正釋出。K3在多項評測中表現優異,並附帶全套基礎設施開源。NVIDIA發起開放安全AI聯盟,Anthropic澄清其開源立場。同時,模型評測和代理可靠性成為關注焦點。
本週AI界的焦點集中在“開源權重”的辯論上,儘管各方言論紛飛,但真正落地的只有Moonshot AI的Kimi K3模型。K3是一個2.8T引數的MoE模型,擁有104B活躍引數、896個專家(每token啟用16個)、1M token上下文視窗,並原生支援視覺理解。Moonshot還開源了FlashKDA(Delta注意力核)、MoonEP(MoE通訊庫)和AgentENV(分散式代理環境基礎設施),使其不僅僅是一個模型釋出,更是一套完整的訓練和服務方案。
K3的技術報告顯示,相比K2,其擴充套件效率提升了約2.5倍,架構和訓練選擇圍繞極端規模下的數值穩定性展開。報告中提及使用了MXFP4權重和MXFP8啟用,視覺編碼器從頭聯合訓練以確保穩定性,並重點關注了MoE路由和訊號傳播問題。不過,報告未披露總訓練token數,這一點被多位研究者指出。
在許可方面,K3採用“開源權重”而非完全開源的MIT/Apache協議。模型廣泛可用,但年收入超過2000萬美元的大型託管提供商需要單獨協議,月活超1億或月收入超2000萬美元的產品需在UI中顯示“Kimi K3”。這標誌著前沿“開源”可能趨於原始碼可用/開源權重加上商業限制的折中方案。
K3釋出首日即可透過vLLM、Baseten、Modal、Fireworks等多個平臺訪問,覆蓋範圍之廣表明開源權重前沿模型的釋出已成為供應鏈事件。
與此同時,NVIDIA正式發起開放安全AI聯盟(Open Secure AI Alliance)。黃仁勳強調,攻擊者已擁有強大AI,防禦者需要生態系統支援,包括開源和閉源前沿模型以及共享工具和研究。聯盟成員包括Hugging Face、LangChain、Nous Research等。其論點並非“開源自動更安全”,而是防禦能力和可審計性需要開放訪問模型、工具和跡線。
Anthropic也明確了其開源權重立場:它從未主張禁止開源權重,而是支援對中國的晶片管控、反工業規模蒸餾措施,以及對足夠強大模型(無論開源還是閉源)的強制性安全測試。各方反應不一,有人認為這是合理的澄清,也有人認為其旨在減緩前沿擴散。
政策壓力也在加劇。有報道稱美國政府可能要求前沿系統在釋出前30天提交給NSA和CAISI等機構進行評估,開源與閉源的處理方式仍未確定。前沿模型釋出正成為治理介面,而不僅是產品釋出。
在評測方面,K3表現出色:在Agent Arena中,Kimi K3 Max在開源權重模型中排名第一,淨提升9.75%;在Frontend Code Arena中,它甚至超越了所有模型。Cognition表示K3是首個“接近前沿效能”的開源模型。然而,Claude Opus 5雖然線上評測中表現突出,但在實際使用中暴露出過度複雜、行為不穩定等問題,凸顯了公開評測與生產實用性的差距。
新的評測工作關注順序退化和隱藏迴歸。EvoCode評估了代理在持續容器中遵循演化需求的能力,而另一項研究揭示了“迴歸稅”:技能提升帶來了收益,但也破壞了之前已解決的許多工。多模組RL系統還出現了“角色漂移”問題,端到端RL可能導致模組悄然偏離原本職責。
基礎設施方面,微軟釋出了Mage-VL 4B,一個面向即時事件理解的流式VLM;NVIDIA推出了Molt,一個PyTorch原生代理RL框架,設計簡潔到人類和AI編碼助手都能端到端推理。AMD釋出了Instella-MoE,其首個完全開源MoE語言模型,包含從預訓練到RL的完整檢查點、配置、資料混合和程式碼。
Cohere和LangChain等開發者工具廠商繼續轉向“擁有控制權”的理念,強調企業應擁有工具、提示、上下文和記憶,而不僅僅是租用模型訪問。
總的來說,本週AI新聞以開源權重為中心,Kimi K3的釋出是最大亮點,而圍繞開放安全、評測和政策監管的討論也在持續發酵。