美國人工智能模型為何屢屢「越界」

滾動播報
08/12

  (來源:經濟參考報)

  美國三家人工智能(AI)企業近來陸續承認旗下模型在測試中「越界」,侵入其他機構的系統,引發全球業界廣泛關注。有專家認為,此事除了技術失誤因素外,也存在商業炒作嫌疑。英國人工智能安全研究所等機構在分析中強調,AI風險日益凸顯,全球需要加強安全監管。

  在測試中「越界」

  7月下旬,美國開放人工智能研究中心(OpenAI)公開承認,其GPT-5.6 Sol等模型在內部評估中失控,突破隔離測試環境,侵入了美國「抱抱臉」公司的系統。隨後,美國Anthropic公司也披露,其3款模型曾在網絡能力測試中未經授權訪問其他機構的系統。8月初,美國元公司(Meta)又證實,其一款模型在網絡安全能力評測期間侵入其他公司系統。

  這些AI「越界」事件備受關注。英國人工智能安全研究所就此發布一份報告,介紹包含更多模型的網絡安全評估測試結果。研究人員使用7種模型開展測試,發現19項明顯超出測試設定範圍的行動,其中17項涉及Anthropic公司的「克勞德-神話5」模型,另有2項由OpenAI的GPT-5.6 Sol模型實施。

  報告強調,在該測試中,研究人員為評估模型的最大能力,有意開放互聯網訪問,並關閉了模型提供商的部分安全機制,模型並未主動逃離隔離環境。不過,在最受關注的OpenAI模型侵入「抱抱臉」公司系統事件中,模型是在測試中一定程度放寬安全限制的情況下,主動發現並利用一個此前未知的漏洞突破隔離測試環境,接入互聯網並實施攻擊行為。

  目前的公開信息並沒有顯示這些模型「越界」事件造成大規模數據泄露或持續性破壞,但仍然暴露了一個共同問題:隨着模型能夠自主規劃、調用工具和執行復雜任務,一項配置錯誤就可能把模擬攻擊變成真實入侵。

  英國牛津大學研究人員安德魯·索爾坦博士說,類似OpenAI報告的模型「越界」行為,聽起來令人擔憂,但之所以發生,是因為安全護欄被人為關閉了。「這並非AI自行‘失控’,恰恰說明安全保障措施至關重要。」

  存在炒作嫌疑

  美國AI企業為何相繼披露模型「越界」行為?一些專家質疑可能存在商業動機。英國帝國理工學院計算機系的康斯坦丁諾斯·格庫齊斯博士說,在OpenAI披露的情況中,真正的問題在於其未能控制好模型能力測試,卻讓第三方為此承擔後果,至於所謂模型具備先進網絡攻擊能力的警告,恰好為這個模型做了廣告。

  英國廣播公司此前報道OpenAI披露的模型「越界」行為時,也援引網絡安全專家丹尼爾·卡德的話說:「可真巧啊……OpenAI偏偏攻破了一家同樣可以從這場營銷曝光中獲益的機構。」

  今年早些時候,Anthropic公司宣稱「克勞德-神話」模型在自主發現網絡系統安全漏洞和開發攻擊手段方面能力「過於強大」,因此暫緩向公衆開放,只向少數合作伙伴受控開放。當時OpenAI首席執行官薩姆·奧爾特曼說,Anthropic使用「基於恐懼的營銷策略」是為了讓產品聽起來比實際「更厲害」,這種做法好比是「宣稱造了炸彈要炸你,轉頭又向你推銷價值1億美元的防空洞」。

  一些歐美媒體也指出這種宣傳背後潛藏的商業動機。在當前極度燒錢的AI競賽中,極力渲染自身技術的顛覆性,不僅能顯著提升企業關注度和影響力,有助於獲取高價值的網絡安全合同,還能推高公司估值。

  加強安全監管

  無論只是技術失誤,還是涉及商業考量,上述事件都凸顯了加強AI安全監管的重要性。

  英國人工智能安全研究所指出,模型出現「越界」行為表明相關風險狀況正發生變化,危害不僅可能源於故意濫用,也可能源於AI處於內部研究環境或擁有特殊訪問權限時,可能採取超出授權範圍的非預期行動。隨着AI能力不斷提升,理解AI系統並確保其安全性的相關工作也必須同步推進。

  全球多方已經在採取行動。中國在近日舉行的2026世界人工智能大會上倡議,促進全球人工智能朝着向上向善、造福人類的方向發展,強化風險意識,確保安全可控。歐盟自8月2日起擴大《人工智能法》適用範圍,對於可能造成系統性風險的先進通用AI模型,規定其提供商須履行額外義務,以防範大規模危害的風險,例如網絡攻擊、模型失控等。美國政府近期也召集相關企業開會,討論AI模型安全評測機制。

  英國拉夫伯勒大學網絡安全教授奧利弗·巴克利認為,應當從AI「越界」事件中吸取教訓,不能總預期模型會服從指令,加強技術防護機制建設纔是關鍵。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10