Artifacts的長期讀者知道,我們持續關注的不只是模型本身,還有它們的許可證。歷史上曾出現過許多自定義許可證,如Qwen2.5 72B-Instruct和Llama系模型都採用過特殊條款;DeepSeek在R1之前也曾為V3設計自定義許可,後來轉向MIT,並帶動許多中國模型廠商在2025年採納MIT或Apache 2.0。
進入2026年,開放模型的競爭更加激烈,許可證趨勢也出現分化:Google和Meta等西方廠商轉向Apache 2.0,而處於前沿的中國廠商則變得更謹慎。例如Kimi K3要求運行推理或微調服務的廠商簽署商業協議,MiniMax M3則設置營收門檻並列出禁止用途。最新的例子是智譜GLM-5.3:它放棄了GLM-5.2及更早版本使用的MIT許可,改為自定義條款。條款核心是,若被許可方或其關聯方的“模型即服務”(MaaS)業務在任意連續12個月內的合計收入超過100億美元,則必須在商用前通過Z.AI的安全審查;審查範圍和方式由Z.AI合理決定。儘管100億美元的門檻看似很高,但條款未定義affiliate(關聯方),帶來不確定性,並可能阻礙採用。該許可證提供中英雙語文本,中文使用“關聯方”一詞,而該詞在中國法律框架下有既有定義。本文不構成法律意見,也理解這類條款背後的商業動機,只是想指出自定義許可可能帶來的採用障礙,尤其在開源與閉源替代方案都很豐富的當下。
這一期的編輯推薦包括:Motif-Technologies的Motif-3採用MIT許可,以遠小於同行的資源取得了令人印象深刻的成績,延續Motif 2.6B和Motif-2-12.7B的上升軌跡。dots-studio的dots3-note-prev來自小紅書(RedNote/Xiaohongshu)生態;他們並非新人,早在2025年就有模型發佈,這次還藉助內部harness在IMO 2026上以滿分獲勝。Qwen的Qwen3.8-Flash-Next是下一代架構的預覽:125B-A6B,包含51B n-gram embedding,搭配GDN與Qwen Sparse Attention;預計類似架構會變得更常見,生態也會在Qwen4發佈前完成集成適配。zai-org的GLM-5.3-Flash則上演了中國模型廠商常見的營銷手法:它先以“Ox-Alpha”的隱身免費模型身份出現在OpenRouter和OpenCode上,引發人們猜測其來自Cursor/xAI、Gemini或某個開源實驗室;由於性能出色,討論持續多日,既製造了熱度,也沖淡了伴隨開放模型發佈常見的“刷榜”質疑。騰訊的Hy4-preview表明騰訊正在開放模型領域認真發力:旗艦模型規模變大,後訓練飛輪持續轉動,目前主要問題是“過度思考”,但從Hy3-preview到Hy3的改進軌跡看,正式版有望衝擊開放模型第一梯隊。
其他通用模型還包括:NVIDIA的Nemotron-3.5-Lightning-30B-A3B-BF16帶來全面的性能與速度改進;螞蟻集團旗下inclusionAI的Ling-3.0-flash採用KDA+Gated MLA混合架構,這是其第三代迭代,並提供7.9B-A1.3B的小版本;阿里巴巴的Qwen3.8-2.4T-A95B令人意外地開始公開其最大尺寸模型,但採用自定義許可證,且性能落後於同尺寸其他模型。更多模型細節與基準可訪問artifactshub.ai查看。