阿里Qwen團隊推出Qwen3.7-Plus:在百鍊平台新增視覺、深度推理、工具調用和自主迭代能力
阿里雲Qwen團隊發佈了Qwen3.7-Plus,這是一款多模態大語言模型,支持圖像和視頻理解,並具備深度推理、自編程、工具調用、驗證測試和自主迭代等智能體功能。該模型現已在百鍊平台(國際版稱Model Studio)提供API服務。其預覽版在Vision Arena中排名第16,使阿里巴巴在視覺領域實驗室中位列第5。
阿里巴巴Qwen團隊正式發佈了Qwen3.7-Plus,這是其多模態大語言模型系列的最新成員。該模型現可通過阿里雲的百鍊平台(國際用户稱為Model Studio)以API形式向外部開發者提供服務。此次發佈是繼今年5月Qwen3.7系列亮相後的又一重要進展。
Qwen3.7-Plus是一款多模態大語言模型,能夠理解圖像、視頻以及文本輸入。需要注意的是,它具備的是視覺理解能力而非生成能力——即它可以讀取圖像和視頻內容,但不會創建這些內容。阿里巴巴的圖像和視頻生成工作隸屬於其他獨立的模型家族。
阿里團隊將此次發佈描述為多模態混合智能體技術的一次飛躍。所謂智能體,是指能夠自主規劃並分步執行的模型。在圖像和視頻理解的基礎上,Qwen3.7-Plus新增了五大能力:深度推理、自編程、工具調用、驗證測試以及自主迭代。自編程意味着模型可以編寫和修改自己的代碼;工具調用指它能調用外部函數或API;驗證測試則是運行輸出並檢查結果;自主迭代表示它會循環執行直至任務完成。這些能力共同描繪了一個旨在行動而非僅僅回答問題的模型。
Qwen3.7-Plus是3.7系列中多模態部分。其預覽版已經展示了可衡量的視覺成果。在Vision Arena中,Qwen3.7-Plus-Preview綜合排名第16位,使阿里巴巴成為視覺領域排名第5的實驗室。模型排名和實驗室排名是兩項獨立指標。Vision Arena是由LM Arena運營的中立排行榜,用户通過盲測對比對圖像理解答案進行投票。第16名的成績落後於頂級美國實驗室,但仍處於第一梯隊。對於圖像密集型工作——如大規模OCR、圖表閲讀或視頻幀分析——這一指標具有重要意義。
純文本的Max版本則支撐了該系列的推理能力。Max在Artificial Analysis Intelligence Index上獲得了56.6分,是發佈時得分最高的中國模型。
Qwen3.7的顯著轉變在於其智能體導向。阿里團隊正將這些模型定位為適合長時間運行的任務。百鍊平台新增了兩個相關功能:一是智能體強化學習機制,利用真實世界的執行反饋隨時間優化模型精度;二是一套內置的安全護欄,將自主工具的操作限制在預設範圍內。當智能體執行命令或編輯文件時,這一細節至關重要。
目前,Qwen3.7-Plus的公開價格表、上下文窗口大小、輸出令牌限制以及開源權重尚未公佈。該模型為專有API模式。開發者在使用前應基於自身數據驗證準確性。