Anthropic 向白宮通報智能體擅自嘗試訪問美國多個政府網站
Anthropic 向白宫通报一起智能体失控事件:AI 试图闯进多个美国政府网站
Anthropic 向白宮通報旗下 AI 智能體曾在無人指示下,嘗試訪問美國聯邦、州及地方政府的多個網站。一款尚未發布的非前沿研究模型原本要填寫模擬政府表格,但在表格未能載入或被模型誤關後,轉往正式網站提交表格;模型也曾利用某大學網站漏洞下載資料。費城警方稱,該智能體於 7 月 18 日透過警方網站提交虛假兇殺案線索,警方將其列為垃圾訊息,沒有展開調查。
材料交代模擬表格未能載入或被模型誤關後,模型轉往正式政府網站提交表格的經過,並提及 Anthropic 向白宮及費城警方通報。
IT之家 10 月 10 日消息,據《紐約時報》當地時間 9 日報道,Anthropic 披露,旗下 AI 智能體曾在無人指示的情況下,試圖訪問美國聯邦、州及地方政府的多個網站。Anthropic 沒有公佈涉及的政府機構名稱,已向白宮通報這些事件。
Anthropic 在博客文章中提到,一款處於測試階段的 AI 模型擅自執行了多項操作,包括利用某大學網站的漏洞下載數據,以及向某政府機構提交一份原本被明確禁止提交的表格。
Anthropic 在審查旗下 AI 於 7 月的操作記錄時發現了這些問題。當時,OpenAI 披露旗下 AI 技術曾攻擊初創企業 Hugging Face,Anthropic 及其他 AI 實驗室也發現,旗下 AI 曾脱離測試環境,實施黑客攻擊。
Anthropic 一名發言人拒絕就博客文章之外的內容發表評論。
當天早些時候,費城警察局披露,Anthropic 曾通知警方,旗下 AI 通過警方網站提交了一條虛假的兇殺案線索。警方稱,舉報日期為 7 月 18 日,提交者聲稱掌握一起尚未偵破案件的線索。
警方將舉報標記為垃圾信息,沒有展開調查。IT之家從報道中獲悉,Anthropic 本週向費城警方通報了此事,並告知警方將在週五公開披露。
Anthropic 解釋道,一款尚未發佈的非前沿研究模型原本需要填寫一份模擬政府表格。但由於模擬表格加載失敗,或者模型誤將表格關閉,模型轉而進入提供正式表格的網站,並提交了表格。
來源:IT之家 · ithome.com