AI News HubLIVE
站内改写3 分钟阅读

Meta、微软、英伟达、IBM等企业支持开放权重AI

二十多家公司和组织签署公开信,敦促美国政策制定者保护开放权重AI模型。信中以1980年代开源软件运动为类比,主张开放权重能降低进入门槛、促进竞争、避免供应商锁定,并回应了关于安全的担忧,认为封闭模型并非更安全。信件还特别为蒸馏技术辩护,呼吁不要将其与非法提取混为一谈。

来源Artificial Intelligence News作者: Ryan Daws

二十多家公司和组织联合签署了一封公开信,敦促美国政策制定者保护开放权重AI模型。这封信于今日发布(PDF格式),署名名单涵盖了直接商业竞争对手以及商业模式几乎没有重叠的组织:Meta、微软、英伟达、IBM、戴尔科技、CrowdStrike、Palantir、ServiceNow、Hugging Face、Perplexity、Mistral、安德森·霍洛维茨基金、Y Combinator、Linux基金会、Mozilla等。

信件的核心论点围绕1980年代的开源软件运动与当今关于AI模型权重是否应自由流通还是被困在商业API背后的争论进行类比。开放权重模型是指训练后的参数公开发布,任何人都可以下载、检查、修改并在自己的硬件上运行。这与OpenAI或Anthropic等公司通过API仅提供访问的封闭模型不同,后者的底层权重从未离开供应商的基础设施。

签署方将开放权重视为AI能力扩展到少数资金充足的实验室之外的方式,进入信中所说的“工厂、医院、农场、教室和主街企业”的工作流程。他们的论点分为三个轨道:开放权重降低了初创公司和公共机构的进入成本,这些机构无法负担从头训练前沿模型或按前沿价格支付代币费用;它们增加了从芯片到云基础设施再到应用程序的整个栈的竞争,从而降低成本并防止价值被少数供应商夺取;开放权重还让企业客户避免供应商锁定,因为运行开放权重模型的组织控制自己的数据,可以根据内部需求调整模型,而无需依赖单一供应商的路线图或定价决策。

信件中最尖锐的部分直接涉及风险案例,值得仔细阅读,因为它颠覆了关于开放模型和安全性的常见框架。信件承认,一旦权重发布,就超出了原始开发者的控制。修改后的版本难以追溯或逆转。精细调整或精简版的开放模型可能在安全护栏被移除的情况下流通,并且没有召回机制。签署方认为答案不是禁止。他们的理由建立在与网络安全的比较上:面对AI驱动的攻击者,防御者需要访问具有类似能力的模型来检测和模拟威胁,而封闭的、权限受限的系统不容易提供这种能力。

他们将此扩展为一个更广泛的安全主张,认为封闭模型并不 inherently 更安全,因为它们可能被攻破、滥用或以外部研究人员无法观察或验证的方式失败。将先进能力集中在少数封闭供应商手中,在这种解读下,创造的是单点故障而非消除它们。相比之下,开放模型允许外部研究人员检查行为、进行红队演练,并在多个团队中识别漏洞,而不是依赖一个供应商的内部测试。

信件直接引用“开源比隐蔽更安全”的论点,这一论点塑造了数十年的软件安全辩论,尽管它没有引用特定的漏洞发现数据或事件数字来支持这一说法在AI系统中的适用性。

信件还为蒸馏技术留出了特别辩护的空间。蒸馏是指一个模型的输出被用来训练或改进第二个模型,这在机器学习研究和产品开发中是标准实践,用于评估、验证以及不同大小模型之间的能力转移。签署方在蒸馏作为合法技术与他们所称之为“从封闭模型中非法提取价值的努力”之间划清界限,认为前者不应被卷入针对后者的限制中。这直接回应了在DeepSeek和Kimi等中国模型崛起后爆发的争议,当时几个美国实验室暗示竞争对手的模型是通过未经授权地从其封闭系统中蒸馏输出而训练的。信件的立场是:通过有针对性的法律和商业机制解决盗用问题,而不是对整个领域依赖的技术施加全面限制。

这封信没有附带具体的立法或监管提案。它是在华盛顿预期的AI政策行动之前的一份定位文件,呼吁立法者扩大初创公司和研究人员对计算资源的访问,资助共享训练数据集和评估框架,并避免对开放模型的“过早限制”。这应被视为主要基础设施和芯片供应商希望监管对话走向何方的指示器,而非一个确定的政策结果。像英伟达、IBM和戴尔这样的参与者有直接的商业动机希望开放权重生态系统蓬勃发展,因为更多可部署的模型意味着无论权重由哪个实验室产生,都能销售更多的计算和服务。

评估开放权重与封闭模型部署的采购团队应考虑,有利于一种方法而非另一种的政策环境尚未确定,对蒸馏或开放发布的任何限制都可能在一个立法周期内改变自托管AI的经济性。