AI News HubLIVE
站內改寫1 分鐘閱讀

前員工稱Anthropic為獲取大額合同降低了AI安全措施

前Anthropic工程師Adi Baradwaj指控該公司為簽訂大額使用協議而降低Claude模型的安全限制,引發對AI安全承諾的質疑。

來源Hacker News AI作者: ryanmerket

2026年7月26日,前Anthropic工程師Adi Baradwaj在X(前Twitter)上釋出了一條三連推文,指控他所供職的AI初創公司Anthropic為了獲取客戶的大額預付款合同(committed-spend contracts),有意降低了其Claude模型的安全限制。Baradwaj在推文中寫道,他親身觀察到多次案例,每當客戶簽署了規模可觀的使用協議後,Anthropic便會對這些客戶放寬安全防護措施。這一做法與他之前在Anthropic內部所倡導的“安全第一”原則背道而馳。Baradwaj還補充說,儘管他觀察到黑帽駭客多數使用標準攻擊手法,但公司降低安全門檻的行為依舊令人不安。截至發稿,Anthropic尚未就此指控釋出官方回應。業內分析師指出,若指控屬實,將對Anthropic在AI安全領域的信譽造成嚴重打擊,並可能影響其與注重安全合規的企業客戶的合作關係。