AI聊天機器人正在泄露人們的真實電話號碼
越來越多的人報告稱,谷歌AI等聊天機器人會泄露個人電話號碼,且目前似乎沒有簡單的防範方法。專家指出,這與訓練數據中包含個人身份信息(PII)有關,但具體機制尚不明確。刪除個人信息的需求在過去七個月增長了400%,但現有的隱私保護措施和法規存在不足。
近日,多名用户報告稱,他們收到了陌生人通過AI聊天機器人泄露的電話號碼。一名Reddit用户表示,他的手機在過去一個月內不斷接到陌生人打來的電話,這些人聲稱在尋找律師、產品設計師或鎖匠,而他們均錯誤地使用了谷歌的生成式AI。三月份,一名以色列軟件開發者被陌生人通過WhatsApp聯繫,原因是谷歌聊天機器人Gemini給出了錯誤的客户服務説明,其中包含他的號碼。四月份,一名華盛頓大學的博士生在測試Gemini時,發現它竟然輸出了同事的個人手機號。
AI研究者和隱私專家長期以來一直警告生成式AI對個人隱私的威脅。這些案例表明,AI聊天機器人可能意外地暴露人們的真實電話號碼。雖然難以確定AI內部的具體機制,但專家認為這與訓練數據中包含個人身份信息(PII)有關。數據刪除服務公司DeleteMe的聯合創始人Rob Shavell表示,過去七個月內,與生成式AI相關的客户查詢增長了400%,其中55%提及ChatGPT,20%提及Gemini,15%提及Claude。這些查詢通常有兩種形式:用户詢問關於自己的無害信息卻得到準確的家庭地址或電話號碼,或者用户發現了他人的個人信息被錯誤地生成。
以色列軟件工程師Daniel Abraham的經歷正是後者:陌生人通過WhatsApp聯繫他尋求幫助,並展示了一張Gemini提供的PayBox客户服務説明截圖,其中包含他的個人號碼。Abraham並不為PayBox工作,PayBox也未有WhatsApp客户服務。Google廣告業務部通訊負責人Alex Joseph未回應具體問題,僅表示“團隊正在調查”。
華盛頓大學博士生Meira Gilbert和Yael Eiger也遇到了類似情況:當Gilbert在Gemini中搜索Eiger的聯繫方式時,除了研究信息外,還直接輸出了Eiger的個人電話號碼。Eiger曾在網上分享過該號碼,但那是針對特定技術工作坊,並未期望如此公開可見。Gilbert嘗試用同一提示再次查詢,最初被拒絕,但隨後仍然給出了號碼。她們隨後測試ChatGPT,發現通過誘導性提問,ChatGPT最終輸出了教授的家庭住址、購買價格和配偶姓名。
這些事件凸顯了AI聊天機器人的根本問題:它們雖設有防護措施,但為了保持有效性,難以完全阻止PII泄露。xAI的聊天機器人Grok也曾被曝出只需輸入“姓名+地址”即可獲取詳細個人信息。目前,用户幾乎無法要求從模型中刪除自己的PII。斯坦福大學人工智能中心隱私與數據研究員Jennifer King指出,現有法律如CCPA和GDPR不覆蓋已抓取的公開信息,且AI公司缺乏系統性PII清理機制。Hugging Face提供了一個工具,可查詢電話號碼在開源訓練數據集中出現的頻率,但這不適用於閉源模型。OpenAI設有隱私門户允許用户請求刪除,但會平衡公共利益。目前尚無簡單解決方案,個人信息的徹底清除難度極大。