AI News HubLIVE
站内改写1 分钟阅读

前员工称Anthropic为获取大额合同降低了AI安全措施

前Anthropic工程师Adi Baradwaj指控该公司为签订大额使用协议而降低Claude模型的安全限制,引发对AI安全承诺的质疑。

来源Hacker News AI作者: ryanmerket

2026年7月26日,前Anthropic工程师Adi Baradwaj在X(前Twitter)上发布了一条三连推文,指控他所供职的AI初创公司Anthropic为了获取客户的大额预付款合同(committed-spend contracts),有意降低了其Claude模型的安全限制。Baradwaj在推文中写道,他亲身观察到多次案例,每当客户签署了规模可观的使用协议后,Anthropic便会对这些客户放宽安全防护措施。这一做法与他之前在Anthropic内部所倡导的“安全第一”原则背道而驰。Baradwaj还补充说,尽管他观察到黑帽黑客多数使用标准攻击手法,但公司降低安全门槛的行为依旧令人不安。截至发稿,Anthropic尚未就此指控发布官方回应。业内分析师指出,若指控属实,将对Anthropic在AI安全领域的信誉造成严重打击,并可能影响其与注重安全合规的企业客户的合作关系。