AI News HubLIVE
站内改写2 分钟阅读

阿里Qwen团队推出Qwen3.7-Plus:在百炼平台新增视觉、深度推理、工具调用和自主迭代能力

阿里云Qwen团队发布了Qwen3.7-Plus,这是一款多模态大语言模型,支持图像和视频理解,并具备深度推理、自编程、工具调用、验证测试和自主迭代等智能体功能。该模型现已在百炼平台(国际版称Model Studio)提供API服务。其预览版在Vision Arena中排名第16,使阿里巴巴在视觉领域实验室中位列第5。

来源MarkTechPost作者: Michal Sutter

阿里巴巴Qwen团队正式发布了Qwen3.7-Plus,这是其多模态大语言模型系列的最新成员。该模型现可通过阿里云的百炼平台(国际用户称为Model Studio)以API形式向外部开发者提供服务。此次发布是继今年5月Qwen3.7系列亮相后的又一重要进展。

Qwen3.7-Plus是一款多模态大语言模型,能够理解图像、视频以及文本输入。需要注意的是,它具备的是视觉理解能力而非生成能力——即它可以读取图像和视频内容,但不会创建这些内容。阿里巴巴的图像和视频生成工作隶属于其他独立的模型家族。

阿里团队将此次发布描述为多模态混合智能体技术的一次飞跃。所谓智能体,是指能够自主规划并分步执行的模型。在图像和视频理解的基础上,Qwen3.7-Plus新增了五大能力:深度推理、自编程、工具调用、验证测试以及自主迭代。自编程意味着模型可以编写和修改自己的代码;工具调用指它能调用外部函数或API;验证测试则是运行输出并检查结果;自主迭代表示它会循环执行直至任务完成。这些能力共同描绘了一个旨在行动而非仅仅回答问题的模型。

Qwen3.7-Plus是3.7系列中多模态部分。其预览版已经展示了可衡量的视觉成果。在Vision Arena中,Qwen3.7-Plus-Preview综合排名第16位,使阿里巴巴成为视觉领域排名第5的实验室。模型排名和实验室排名是两项独立指标。Vision Arena是由LM Arena运营的中立排行榜,用户通过盲测对比对图像理解答案进行投票。第16名的成绩落后于顶级美国实验室,但仍处于第一梯队。对于图像密集型工作——如大规模OCR、图表阅读或视频帧分析——这一指标具有重要意义。

纯文本的Max版本则支撑了该系列的推理能力。Max在Artificial Analysis Intelligence Index上获得了56.6分,是发布时得分最高的中国模型。

Qwen3.7的显著转变在于其智能体导向。阿里团队正将这些模型定位为适合长时间运行的任务。百炼平台新增了两个相关功能:一是智能体强化学习机制,利用真实世界的执行反馈随时间优化模型精度;二是一套内置的安全护栏,将自主工具的操作限制在预设范围内。当智能体执行命令或编辑文件时,这一细节至关重要。

目前,Qwen3.7-Plus的公开价格表、上下文窗口大小、输出令牌限制以及开源权重尚未公布。该模型为专有API模式。开发者在使用前应基于自身数据验证准确性。