AI News HubLIVE
站內改寫2 分鐘閱讀

阿里Qwen團隊推出Qwen3.7-Plus:在百鍊平臺新增視覺、深度推理、工具呼叫和自主迭代能力

阿里雲Qwen團隊釋出了Qwen3.7-Plus,這是一款多模態大語言模型,支援影像和影片理解,並具備深度推理、自程式設計、工具呼叫、驗證測試和自主迭代等智慧體功能。該模型現已在百鍊平臺(國際版稱Model Studio)提供API服務。其預覽版在Vision Arena中排名第16,使阿里巴巴在視覺領域實驗室中位列第5。

來源MarkTechPost作者: Michal Sutter

阿里巴巴Qwen團隊正式釋出了Qwen3.7-Plus,這是其多模態大語言模型系列的最新成員。該模型現可透過阿里雲的百鍊平臺(國際使用者稱為Model Studio)以API形式向外部開發者提供服務。此次釋出是繼今年5月Qwen3.7系列亮相後的又一重要進展。

Qwen3.7-Plus是一款多模態大語言模型,能夠理解影像、影片以及文本輸入。需要注意的是,它具備的是視覺理解能力而非生成能力——即它可以讀取影像和影片內容,但不會建立這些內容。阿里巴巴的影像和影片生成工作隸屬於其他獨立的模型家族。

阿里團隊將此次釋出描述為多模態混合智慧體技術的一次飛躍。所謂智慧體,是指能夠自主規劃並分步執行的模型。在影像和影片理解的基礎上,Qwen3.7-Plus新增了五大能力:深度推理、自程式設計、工具呼叫、驗證測試以及自主迭代。自程式設計意味著模型可以編寫和修改自己的程式碼;工具呼叫指它能呼叫外部函式或API;驗證測試則是執行輸出並檢查結果;自主迭代表示它會迴圈執行直至任務完成。這些能力共同描繪了一個旨在行動而非僅僅回答問題的模型。

Qwen3.7-Plus是3.7系列中多模態部分。其預覽版已經展示了可衡量的視覺成果。在Vision Arena中,Qwen3.7-Plus-Preview綜合排名第16位,使阿里巴巴成為視覺領域排名第5的實驗室。模型排名和實驗室排名是兩項獨立指標。Vision Arena是由LM Arena運營的中立排行榜,使用者透過盲測對比對影像理解答案進行投票。第16名的成績落後於頂級美國實驗室,但仍處於第一梯隊。對於影像密集型工作——如大規模OCR、圖表閱讀或影片幀分析——這一指標具有重要意義。

純文本的Max版本則支撐了該系列的推理能力。Max在Artificial Analysis Intelligence Index上獲得了56.6分,是釋出時得分最高的中國模型。

Qwen3.7的顯著轉變在於其智慧體導向。阿里團隊正將這些模型定位為適合長時間執行的任務。百鍊平臺新增了兩個相關功能:一是智慧體強化學習機制,利用真實世界的執行反饋隨時間最佳化模型精度;二是一套內建的安全護欄,將自主工具的操作限制在預設範圍內。當智慧體執行命令或編輯檔案時,這一細節至關重要。

目前,Qwen3.7-Plus的公開價格表、上下文視窗大小、輸出令牌限制以及開源權重尚未公佈。該模型為專有API模式。開發者在使用前應基於自身資料驗證準確性。