Together AI宣佈與Moonshot AI建立戰略合作伙伴關係,原生服務Kimi模型
Together AI與Moonshot AI達成戰略合作,成為Moonshot模型釋出的啟動平臺,首款模型為2.8萬億引數的Kimi K3,後續所有開源模型也將登陸Together AI。
Together AI今日宣佈與Moonshot AI建立戰略合作伙伴關係,後者是開源社群中大規模MoE架構的領先者。根據協議,Together AI將成為Moonshot模型釋出的啟動平臺,首先推出Kimi K3,並涵蓋Moonshot未來所有開源權重模型。
對於基於開源模型構建的開發者而言,這意味著他們能夠透過Together AI的美國託管基礎設施、定價模型和工具,在模型釋出的第一時間獲得Moonshot的前沿成果,同時確保零資料保留和合規的模型及資料訪問。開發者還可以使用自己的資料對這些模型進行後訓練,以提升應用的質量和效能。
Kimi K3是迄今為止釋出的最大開源模型:一個2.8萬億引數的稀疏混合專家模型,原生支援視覺,上下文視窗達100萬token。Moonshot圍繞兩個新的架構元件構建了它:Kimi Delta Attention (KDA) 改變了資訊在序列長度上的流動方式,在長上下文下顯著加速解碼;Attention Residuals (AttnRes) 則改進了表示在模型深度上的檢索,以最小的額外計算成本提高了訓練效率。此外,還採用了包括逐頭Muon和基於分位數的專家負載均衡在內的一系列最佳化器改進,Moonshot稱這些組合相比Kimi K2實現了約2.5倍的擴充套件效率提升。結果是一個專為長週期編碼、代理工作流、遊戲開發和知識密集型任務設計的模型,其基準測試結果使其與當前市場上的領先專有系統直接競爭。
Kimi模型可在Together AI的所有推理產品中使用,包括Serverless、Provisioned Throughput和Dedicated Inference。開發者可以從試用模型到將其應用於生產用例,享受SLA支援和自動擴充套件。Provisioned Throughput為前沿開源模型提供基於token的定價和99%正常執行時間SLA,是閉源模型提供商已有的預留容量保證,現在對開源權重開放。Dedicated Model Inference則提供更快的部署、更好的token經濟學和持續的研究創新。
開發者還可以對Kimi模型進行後訓練,以針對特定用例提高質量。自定義訓練包括全權重和LoRA強化學習以及高階監督微調,開發者可以透過Python SDK和細粒度原語配置訓練,並在專用容量上併發執行多個LoRA實驗。自定義訓練將實驗直接連線到生產,當檢查點準備好評估時,可以原生部署到推理,無需訓練和服務之間的單獨交接。
此次合作解鎖了多項開發者權益:第一時間可用性、經過驗證的擴充套件規模與生產就緒基礎設施、一個整合覆蓋Moonshot全系列、第一天即可進行後訓練、以及開源權重帶來的控制選擇。Together AI的推理棧已經為Cursor、Y Combinator和Decagon等公司處理生產流量,部署編碼和代理工作負載。
歡迎參加Moonshot與Together的聯合網路研討會,與Moonshot AI和Together AI團隊直接交流Kimi K3的技術決策和實際應用。