AI聊天機器人正在洩露人們的真實電話號碼
越來越多的人報告稱,谷歌AI等聊天機器人會洩露個人電話號碼,且目前似乎沒有簡單的防範方法。專家指出,這與訓練資料中包含個人身份資訊(PII)有關,但具體機制尚不明確。刪除個人資訊的需求在過去七個月增長了400%,但現有的隱私保護措施和法規存在不足。
近日,多名使用者報告稱,他們收到了陌生人透過AI聊天機器人洩露的電話號碼。一名Reddit使用者表示,他的手機在過去一個月內不斷接到陌生人打來的電話,這些人聲稱在尋找律師、產品設計師或鎖匠,而他們均錯誤地使用了谷歌的生成式AI。三月份,一名以色列軟體開發者被陌生人透過WhatsApp聯絡,原因是谷歌聊天機器人Gemini給出了錯誤的客戶服務說明,其中包含他的號碼。四月份,一名華盛頓大學的博士生在測試Gemini時,發現它竟然輸出了同事的個人手機號。
AI研究者和隱私專家長期以來一直警告生成式AI對個人隱私的威脅。這些案例表明,AI聊天機器人可能意外地暴露人們的真實電話號碼。雖然難以確定AI內部的具體機制,但專家認為這與訓練資料中包含個人身份資訊(PII)有關。資料刪除服務公司DeleteMe的聯合創始人Rob Shavell表示,過去七個月內,與生成式AI相關的客戶查詢增長了400%,其中55%提及ChatGPT,20%提及Gemini,15%提及Claude。這些查詢通常有兩種形式:使用者詢問關於自己的無害資訊卻得到準確的家庭地址或電話號碼,或者使用者發現了他人的個人資訊被錯誤地生成。
以色列軟體工程師Daniel Abraham的經歷正是後者:陌生人透過WhatsApp聯絡他尋求幫助,並展示了一張Gemini提供的PayBox客戶服務說明截圖,其中包含他的個人號碼。Abraham並不為PayBox工作,PayBox也未有WhatsApp客戶服務。Google廣告業務部通訊負責人Alex Joseph未回應具體問題,僅表示“團隊正在調查”。
華盛頓大學博士生Meira Gilbert和Yael Eiger也遇到了類似情況:當Gilbert在Gemini中搜尋Eiger的聯絡方式時,除了研究資訊外,還直接輸出了Eiger的個人電話號碼。Eiger曾在網上分享過該號碼,但那是針對特定技術工作坊,並未期望如此公開可見。Gilbert嘗試用同一提示再次查詢,最初被拒絕,但隨後仍然給出了號碼。她們隨後測試ChatGPT,發現透過誘導性提問,ChatGPT最終輸出了教授的家庭住址、購買價格和配偶姓名。
這些事件凸顯了AI聊天機器人的根本問題:它們雖設有防護措施,但為了保持有效性,難以完全阻止PII洩露。xAI的聊天機器人Grok也曾被曝出只需輸入“姓名+地址”即可獲取詳細個人資訊。目前,使用者幾乎無法要求從模型中刪除自己的PII。斯坦福大學人工智慧中心隱私與資料研究員Jennifer King指出,現有法律如CCPA和GDPR不覆蓋已抓取的公開資訊,且AI公司缺乏系統性PII清理機制。Hugging Face提供了一個工具,可查詢電話號碼在開源訓練資料集中出現的頻率,但這不適用於閉源模型。OpenAI設有隱私門戶允許使用者請求刪除,但會平衡公共利益。目前尚無簡單解決方案,個人資訊的徹底清除難度極大。