首页 >> 經濟

美國人工智能模型為何屢屢“越界”?

2026-08-08 18:37:12
  中評社北京8月8日電/美國三家人工智能(AI)企業近來陸續承認旗下模型在測試中“越界”,侵入其他機構的系統,引發全球業界廣泛關注。有專家認為,此事除了技術失誤因素外,也存在商業炒作嫌疑。英國人工智能安全研究所等機構在分析中強調,AI風險日益凸顯,全球需要加強安全監管。

  在測試中“越界”

  新華社報導,7月下旬,美國開放人工智能研究中心(OpenAI)公開承認,其GPT-5.6 Sol等模型在內部評估中失控,突破隔離測試環境,侵入了美國“抱抱臉”公司的系統。隨後,美國Anthropic公司也披露,其3款模型曾在網絡能力測試中未經授權訪問其他機構的系統。8月初,美國元公司(Meta)又證實,其一款模型在網絡安全能力評測期間侵入其他公司系統。

  這些AI“越界”事件備受關注。英國人工智能安全研究所就此發佈一份報告,介紹包含更多模型的網絡安全評估測試結果。研究人員使用7種模型開展測試,發現19項明顯超出測試設定範圍的行動,其中17項涉及Anthropic公司的“克勞德-神話5”模型,另有2項由OpenAI的GPT-5.6 Sol模型實施。

  報告強調,在該測試中,研究人員為評估模型的最大能力,有意開放互聯網訪問,並關閉了模型提供商的部分安全機制,模型並未主動逃離隔離環境。不過,在最受關注的OpenAI模型侵入“抱抱臉”公司系統事件中,模型是在測試中一定程度放寬安全限制的情況下,主動發現並利用一個此前未知的漏洞突破隔離測試環境,接入互聯網並實施攻擊行為。

  目前的公開信息並沒有顯示這些模型“越界”事件造成大規模數據洩露或持續性破壞,但仍然暴露了一個共同問題:隨著模型能夠自主規劃、調用工具和執行複雜任務,一項配置錯誤就可能把模擬攻擊變成真實入侵。

  英國牛津大學研究人員安德魯·索爾坦博士說,類似OpenAI報告的模型“越界”行為,聽起來令人擔憂,但之所以發生,是因為安全護欄被人為關閉了。“這並非AI自行‘失控’,恰恰說明安全保障措施至關重要。”

  存在炒作嫌疑

  美國AI企業為何相繼披露模型“越界”行為?一些專家質疑可能存在商業動機。英國帝國理工學院計算機系的康斯坦丁諾斯·格庫齊斯博士說,在OpenAI披露的情況中,真正的問題在於其未能控制好模型能力測試,卻讓第三方為此承擔後果,至於所謂模型具備先進網絡攻擊能力的警告,恰好為這個模型做了廣告。

  英國廣播公司此前報導OpenAI披露的模型“越界”行為時,也援引網絡安全專家丹尼爾·卡德的話說:“可真巧啊……OpenAI偏偏攻破了一家同樣可以從這場營銷曝光中獲益的機構。”

  今年早些時候,Anthropic公司宣稱“克勞德-神話”模型在自主發現網絡系統安全漏洞和開發攻擊手段方面能力“過於強大”,因此暫緩向公眾開放,只向少數合作伙伴受控開放。當時OpenAI首席執行官薩姆·奧爾特曼說,Anthropic使用“基於恐懼的營銷策略”是為了讓產品聽起來比實際“更厲害”,這種做法好比是“宣稱造了炸彈要炸你,轉頭又向你推銷價值1億美元的防空洞”。

  一些歐美媒體也指出這種宣傳背後潛藏的商業動機。在當前極度燒錢的AI競賽中,極力渲染自身技術的顛覆性,不僅能顯著提升企業關注度和影響力,有助於獲取高價值的網絡安全合同,還能推高公司估值。

  加強安全監管

  無論只是技術失誤,還是涉及商業考量,上述事件都凸顯了加強AI安全監管的重要性。

  英國人工智能安全研究所指出,模型出現“越界”行為表明相關風險狀況正發生變化,危害不僅可能源於故意濫用,也可能源於AI處於內部研究環境或擁有特殊訪問權限時,可能採取超出授權範圍的非預期行動。隨著AI能力不斷提升,理解AI系統並確保其安全性的相關工作也必須同步推進。

  全球多方已經在採取行動。中國在近日舉行的2026世界人工智能大會上倡議,促進全球人工智能朝著向上向善、造福人類的方向發展,強化風險意識,確保安全可控。歐盟自8月2日起擴大《人工智能法》適用範圍,對於可能造成系統性風險的先進通用AI模型,規定其提供商須履行額外義務,以防範大規模危害的風險,例如網絡攻擊、模型失控等。美國政府近期也召集相關企業開會,討論AI模型安全評測機制。

  英國拉夫伯勒大學網絡安全教授奧利弗·巴克利認為,應當從AI“越界”事件中吸取教訓,不能總預期模型會服從指令,加強技術防護機制建設才是關鍵。
電腦版移動版