馬丁·托馬斯在來信中提出一個尖鋭的問題:任何理性的人,如何能斷言獨立監督與監管就足以應對AI帶來的風險?
觸發這一質疑的,是又一次前沿AI模型被撤回的事件。該模型因為未能通過安全測試而被取消發佈(據9月28日報道,OpenAI因內部測試中的安全顧慮而放棄發佈一款新模型)。與以往一樣,隨之而來的是關於“獨立監督與監管”的呼籲,但托馬斯指出,這些呼籲從未解釋監管具體將如何運作,更沒有回答最關鍵的問題:什麼樣的證據才應當説服監管者,認定某個AI系統已經足夠安全。
托馬斯援引工程界的既有傳統作為對照。長期以來,安全關鍵軟件系統——例如控制飛機或核電站的系統——一直處於嚴格的監管框架之下。相關國際標準要求提交所謂的“安全論證”:這是一套嚴謹的分析,用以表明所有可能出現的危害都已被識別並得到控制,而且發生事故的概率被壓至極低水平。
在他看來,這正是當前AI安全辯論中缺失的一環。僅僅重複呼籲開展獨立監督和監管,並不能替代對安全證據標準的明確界定。若不能説明監管者應當看到什麼、依據什麼作出判斷,那麼再多的監管口號也難以真正保證AI系統的安全性。