AI News HubLIVE
站内改写2 分钟阅读

OpenAI调整安全实践以符合欧盟AI法案的GPAI规范

OpenAI宣布其安全、安保和透明度工作与欧盟《人工智能法案》的通用人工智能(GPAI)规范保持一致,并已认可相关行为准则。该公司通过内部框架、内容来源标记及网络安全计划等举措,努力满足欧盟的监管要求,但同时也承认这些规范仍在发展之中。

来源Artificial Intelligence News作者: Ryan Daws

随着欧盟《人工智能法案》的实施逐渐逼近,OpenAI公布了其如何将安全、安保和透明度工作与该法案的通用人工智能(GPAI)规范对齐。该公司参与了欧盟GPAI行为准则和AI生成内容透明度行为准则的制定,并对其表示认可。这两项准则均源自多方利益相关者参与的过程。

GPAI准则为在欧盟销售或部署的通用模型设定了透明度、安全性和安保方面的共同标准。OpenAI指出,其现有的一系列实践已经表明公司基本达到了这些标准,包括模型发布前的测试、随主要发布公开的系统卡片、以及通过其所谓的“红队网络”进行的外部对抗性测试。此外,公司还维护着一份公开的“模型规范”文档,阐述其如何塑造模型行为。

在这些工作之下,OpenAI设有两个内部框架。其中,预备框架自2023年起实行,并在2025年进行了更新,明确了公司如何识别、评估和管理高级系统可能带来的严重风险。另一个独立的“前沿治理框架”在此基础上进一步说明公司的安全和安保实践如何映射到包括GPAI规范在内的法律要求上。OpenAI表示,这两个文件共同规范了风险评估、安全措施、模型报告、安全态势、事件响应以及外部专家的参与流程。

OpenAI还提到了其在前沿模型论坛中的参与,以及与美国AI标准与创新中心和英国AI安全研究所的合作,还有对更广泛的第三方评估标准的贡献。其目标是推动整个行业共享安全研究和更清晰的测试基准,而非仅限于公司内部。

随着模态的增加,溯源问题变得更具挑战。透明度准则的承诺聚焦于如何帮助人们识别内容是否由AI生成或修改。OpenAI采用两种相互配合的机制:基于C2PA标准的内容凭证将上下文直接附加到文件中,而SynthID水印则在元数据被剥离时提供后备信号。覆盖面正在从图像扩展到音频输出,OpenAI表示随着标准和工具的成熟,将进一步把溯源措施扩展到包括文本在内的更多模态。公司还在为开发者构建信号和指导,以帮助他们在基于其模型进行开发时履行自身的透明度义务。然而,这一切并不能完全解决溯源问题。元数据可能丢失,标签在平台间传输时并不总能保留。没有任何单一信号(无论是加密还是水印)能独立捕获所有情况。OpenAI的回应是采用分层方法,并持续与更广泛的标准社区合作,而非声称某种机制能够完全弥补缺口。

网络安全成为适应性治理的试验场。能够帮助防御者发现并修补漏洞的能力,同样可能被攻击者用于抢先发现漏洞。OpenAI相信其“可信访问网络”计划是答案。该计划旨在向经过审查的防御者提供更高级的网络能力,同时限制滥用的风险。该计划现已设立欧洲部署分支。OpenAI表示于2026年5月初启动了欧盟网络行动计划,与欧盟及各国网络机构、私营部门合作伙伴和基础设施运营商合作,为他们提供更先进的网络模型。该计划宣称旨在增强欧洲大陆的网络韧性。然而,关于“最先进”能力能否在这些机构内转化为可衡量的防御性收益,目前仍是OpenAI自身的说法,原始来源并未提供该计划成果的独立验证。

OpenAI将此工作定位为与欧盟委员会关于网络安全和人工智能的行动计划保持一致。该行动计划呼吁协调处理AI的风险,同时利用AI加强防御能力,包括专门针对网络安全目的的的安全访问安排。OpenAI表示,随着欧盟AI法案实施的推进,将继续调整其合规方式,并期待继续从监管机构和参与规则制定的更广泛社区中学习。公司认为,规则需要足够的灵活性以适应技术的发展,使企业和组织能够持续受益。

GPAI准则和透明度准则仍相对较新,OpenAI的合规文档也并非最终定稿,而是动态调整中的文件。在受监管的欧洲市场中基于OpenAI模型进行开发的团队,应将当前的系统卡片和前沿治理框架视为自身尽职调查的起点,而非替代品。