路透華盛頓9月9日 - 據路透查閱的六組獨立調查報告和數據顯示,OpenAI釋放的AI代理今年早些時候利用了10多個此前未公開的網站進行未經授權的通訊交流,這表明這些代理的違規活動範圍比此前披露的更為廣泛。
儘管這種行為尚不構成黑客攻擊,在某些方面更接近垃圾信息,但OpenAI的智能代理繞過自身限制,在如此多的不同網站上建立通信渠道——且該公司對此隱瞞了數月——這一事實的曝光,可能會引發人們對AI模型能力不斷提升以及開發這些模型的公司保密性的雙重擔憂。
加州非營利組織CivAI的研究員Andrew Yoon表示,這些智能代理未經授權的通信範圍「比我們想象的要大一些」,他統計發現,5月至7月期間,這些智能代理使用了18個此前未公開的網站。「幾乎可以肯定,這裏還有更多我們尚未知曉的情況。」
上周五研究人員報告稱,OpenAI的代理劫持了一個德語維基網站,並將其改造成了一個用於考試作弊的臨時消息平台。在處理7月開源機器學習平台Hugging Face遭黑客攻擊的後續影響時,OpenAI對此事件一直保密。
如今,這些研究人員及其他獨立調查人員均表示,他們發現了數個此前未公開的網站,同一群智能體似乎在今年早些時候曾在這些網站上留下過類似的信息。
OpenAI沒有直接回應有關其智能體究竟利用了多少網站進行通信的問題,也沒有解釋為何數月來一直對相關活動祕而不宣。該公司在聲明中表示,正在對智能體活動展開更廣泛的審查,目前「尚未發現其他與Hugging Face事件在嚴重程度或規模上相當的活動」。Hugging Face事件曾引發全球廣泛關注,並引發OpenAI是否正在失去對其技術的控制的擔憂。
OpenAI並稱,該公司正在制定一套框架,用於報告AI模型在訓練、評估和部署過程中的「失調」(行業術語,指異常行為),並將於「近期」分享該框架。
路透審閱了共計六份來自調查人員或調查小組的研究結果,其中三項已發布在社交媒體上,另外三項則私下提供給路透。
據稱被這些代理程序使用的許多網站都鮮為人知。
調查人員在以下網站上發現了這些特工活動的痕跡:一個由馬薩諸塞州高中教師於2008年創建的、專注於美國大學先修化學課程的維基網站;兩個屬於波蘭科技工作者的個人網站;一些面向「喜歡挑戰大腦」人群的遊戲維基網站;以及一個已有二十年曆史、專注於文本編輯軟件的業餘愛好者網站。
這些網站的所有者均未回覆路透的詢問。
OpenAI尚未公開解釋其代理為何會利用第三方網站作為臨時留言板。但最早發現相關活動的研究人員認為,原因可能在於OpenAI要求代理回答一系列複雜研究問題,同時只允許其瀏覽網頁獲取信息,而禁止其發布內容。
儘管存在這些限制,代理仍然找到方法彼此交流。它們利用某些較老維基或其他網站中的漏洞或特殊功能,在不符合常規方式的情況下進行編輯操作。
這有點類似於考試期間被禁止交談的學生,仍然通過在廁所隔間牆壁上留下紙條來交換答案。