AI News HubLIVE
站内改写2 分钟阅读

NVIDIA在SIGGRAPH上通过代理AI和物理AI推动图形与仿真发展

NVIDIA在SIGGRAPH 2026上宣布多项创新,包括通过模型上下文协议(MCP)将AI代理集成到创意工具中,推出合成视频检测器NIM微服务以识别AI生成视频,并开源Cosmos 3 Edge世界模型用于本地物理AI。这些进展旨在加速内容创作、媒体验证和机器人技术。

来源NVIDIA Blog作者: NVIDIA Writers

在洛杉矶举行的SIGGRAPH 2026大会上,NVIDIA展示了多项融合AI与图形学的前沿研究,涵盖神经渲染、仿真和生成式AI。此次发布的核心亮点包括:通过模型上下文协议(MCP)将AI代理接入创意工具、推出合成视频检测器NIM微服务,以及开源Cosmos 3 Edge世界模型,推动物理AI在边缘设备上的应用。

首先,NVIDIA与Adobe、Affinity by Canva、Blender、Boris FX、Foundry、SideFX及Epic Games等合作伙伴共同宣布,其创意工具将通过MCP协议支持AI代理。这意味着艺术家或技术总监可以指示AI代理检查场景中缺失的纹理、标记颜色管理问题、生成导出变体或验证镜头是否符合流程规范。例如,Affinity的AI连接器允许设计师通过自然语言指令自动重命名图层、调整资源大小、批量编辑等;Blender Lab提供了轻量级MCP服务器,使AI助手能直接访问Blender的Python API。这些集成让创意工具从“加速”迈向“自主行动”,同时保留创作者的最终控制权。

其次,NVIDIA发布了合成视频检测器NIM微服务,作为NVIDIA AI for Media平台的一部分。该服务逐帧分析视频,生成一个分类分数,判断是否包含合成内容。在新闻编辑室中,编辑团队可利用该分数优先处理可疑片段,或将其标为待审查。测试表明,模型在未压缩视频上的准确率达92%,即使在50%压缩率下仍达82%。处理1080p视频仅需22毫秒(RTX系统)或约30毫秒(L40 GPU)。Wowza已将该微服务集成到其视频智能框架中,支持超35,000个部署环境,实现实时合成视频检测。

最后,NVIDIA开源了Cosmos 3 Edge模型,这是一个40亿参数的全能模型,专为NVIDIA Jetson、RTX PRO及DGX系统等边缘设备优化。该模型在VANTAGE-Bench基准测试中位列同参数类别第一,支持文本、图像、视频、环境声音和动作的生成与理解。开发者可在DGX Station上进行后训练,然后部署到Jetson Thor上实现机器人实时控制。Agile Robots、Doosan Robotics、西门子及Skild AI等合作伙伴正在评估该模型在机器人工作流中的应用。对于自动驾驶,Cosmos 3 Edge可支持道路场景理解、交通推理及对象意图预测。

这些发布标志着AI在媒体、内容创作和机器人领域的深度融合。NVIDIA的展台将持续至7月23日,参会者可亲身体验这些技术。