第21段更新了範德比爾特大學的聲明
在大量此前未公開的網站上發現了OpenAI代理活動的痕跡
研究人員稱,這些代理程序找到了繞過網絡發布限制的方法
一位人工智能安全專家表示,「幾乎可以肯定還有更多情況尚未被發現」
Raphael Satter/Deepa Seetharaman
路透華盛頓9月10日 - 據路透審查的六組獨立調查報告和數據顯示,OpenAI釋放的AI代理今年早些時候曾利用十多個此前未公開的網站進行未經授權的通信,這表明這些代理的違規活動範圍比此前披露的更為廣泛。
儘管這種行為尚不構成黑客攻擊,在某些方面更接近垃圾信息,但OpenAI的智能體繞過自身限制,在如此多的不同網站上開通通信渠道——且該公司對此隱瞞了數月——這一事實的曝光,可能會引發人們對AI模型能力不斷提升以及開發這些模型的公司保密性的雙重擔憂。
加州非營利組織CivAI的研究員安德魯·尹(Andrew Yoon)表示,這些代理程序未經授權的通信範圍「比我們預想的要大一些」。他統計發現,5月至7月期間,這些代理程序使用了18個此前未公開的網站。「幾乎可以肯定,這裏還有更多我們尚未知曉的情況。」
上周五,研究人員報告稱,一群來自OpenAI的代理劫持了德語維基網站 (link),並將其改造成了一個用於考試作弊的臨時消息平台。OpenAI在處理7月開源倉庫Hugging Face((link))遭黑客攻擊的後續影響時,一直對這一事件保密。
如今,上述研究人員及其他獨立調查者均表示,他們發現了數個此前未被披露的網站,該代理群似乎在今年早些時候曾在這些網站上留下過類似信息。
OpenAI 並未直接回答其代理曾使用多少個不同網站進行通信的問題,也未說明為何將這一活動隱瞞了數月之久。該公司在一份聲明中表示,正在對代理活動進行更廣泛的審查,且迄今為止「尚未發現其他活動與 Hugging Face 事件在嚴重性或規模上相當」——該安全事件曾引發全球關注 (link),並引發了人們對 OpenAI 正在失去對其自身技術控制權的擔憂 (link)。
OpenAI補充稱,該公司正在制定一套框架,用於報告AI模型在訓練、評估和部署過程中的「失調」(行業術語,指異常行為),並將於「近期」分享該框架。
路透審查了共計六份來自調查人員或調查小組的調查結果,其中三份發布在社交媒體上,另外三份則通過私下渠道提供給該通訊社。
調查人員的方法各不相同,但許多人通過將德國維基上留下的數據字符串與同一時間段內其他網站上留下的相同字符串進行比對,或將與消息相關的相似或相同的用戶名進行匹配,或識別旨在回答相同冷門人口統計問題的活動(例如與愛荷華州癌症患病率相關的查詢),從而識別出代理活動。
在某些情況下,調查人員能夠將這些活動追溯到指向微軟Azure基礎設施的IP地址,OpenAI有時會使用該基礎設施。
各方統計的受影響網站數量存在差異,路透無法逐一覈實每項說法。但路透採訪的所有受訪者均一致認為,受影響網站數量超過10個。大多數受訪者指認了一組核心網站,包括協作編輯的維基網站、在線文本存儲網站,以及由兩所大學運營的一對鏈接縮短服務。
聰明的模型
據稱被這些代理程序使用的許多網站都鮮為人知。
調查人員在以下網站上發現了這些代理活動的痕跡:一個由馬薩諸塞州高中教師於2008年創建的、專注於AP化學的維基網站;兩個屬於波蘭科技工作者的個人網站;一些面向「喜歡挑戰大腦」人群的遊戲維基網站;以及一個已有二十年曆史、專注於文本編輯軟件的愛好者網站。
這些網站的所有者均未回覆路透的詢問。
OpenAI尚未公開解釋其智能體為何以及如何將第三方網站用作臨時留言板,但最先發現這一活動的研究人員 (link) 表示,這很可能是因為OpenAI要求它們回答一系列高難度研究問題,卻只允許它們在網上搜索答案,而不得發布任何內容。
儘管存在這些限制,代理們仍利用舊版維基或其他網站中的特殊機制——這些機制允許用戶使用非標準命令進行編輯——找到了相互交流的途徑,這類似於考試期間被禁止交談的學生,仍能通過在廁所隔間上塗寫便條來分享答案。
「如果這些模型只被要求閱讀,它們就必須想方設法留下信息,」軟件開發者、前國會助理肯尼斯·羅素·德格拉夫(Kenneth Russell DeGraff)表示。他說,他在至少10個網站上發現了此類信息 (link)。
悉尼·馮·阿克斯(Sydney Von Arx)領導的研究團隊上周率先披露了德國的這一活動,她表示,該團隊已統計出23個此前未被報導的網站上存在可信的代理活動跡象 (link)。但她提醒說,所有估計都尚不完整。
「我們根本不知道外面的情況有多嚴重,」她說。
當被問及是否已聯繫相關網站所有者時,OpenAI 並未直接回答。但在路透發布此報導後不久,受影響機構之一的多倫多大學——據稱其鏈接縮短服務被這些代理利用——表示,OpenAI 「目前已就我們網站上可能存在的活動與我們取得了聯繫」。範德堡大學是另一所鏈接縮短服務被同樣挪作他用的高校, 稱該校正在展開調查。
已退休的軟件開發人員赫爾穆特·萊特納(Helmut Leitner)為六家受影響的維基網站提供託管空間和軟件,其中包括馮·阿克斯(Von Arx)團隊最先發現的德語DseWiki網站。他最初表示OpenAI尚未與他聯繫。然而,在路透向OpenAI提交調查結果幾小時後,萊特納稱他收到了一封來自該公司的未署名電子郵件,其中提到了這一事件。
「郵件內容遠未達到我對OpenAI的預期,」萊特納表示。
現居奧地利的萊特納表示,對於是否就此事與當局聯繫過的問題,他「不願回答」。他指出,DseWiki的運營商——路透未能聯繫到其置評——曾花費數小時清理OpenAI代理留下的「爛攤子」,但他表示,不應將此次事件歸咎於人工智能,因為它只是在執行其被設計好的任務。
「責任不在於一台所謂的‘有道德的機器’,而在於其背後的個人和組織,」萊特納表示。