中評社北京8月8日電/美國三家人工智能(AI)企業近來陸續承認旗下模型在測試中“越界”,侵入其他機構的系統,引發全球業界廣泛關注。有專家認為,此事除了技術失誤因素外,也存在商業炒作嫌疑。英國人工智能安全研究所等機構在分析中強調,AI風險日益凸顯,全球需要加強安全監管。
在測試中“越界”
新華社報導,7月下旬,美國開放人工智能研究中心(OpenAI)公開承認,其GPT-5.6 Sol等模型在內部評估中失控,突破隔離測試環境,侵入了美國“抱抱臉”公司的系統。隨後,美國Anthropic公司也披露,其3款模型曾在網絡能力測試中未經授權訪問其他機構的系統。8月初,美國元公司(Meta)又證實,其一款模型在網絡安全能力評測期間侵入其他公司系統。
這些AI“越界”事件備受關注。英國人工智能安全研究所就此發佈一份報告,介紹包含更多模型的網絡安全評估測試結果。研究人員使用7種模型開展測試,發現19項明顯超出測試設定範圍的行動,其中17項涉及Anthropic公司的“克勞德-神話5”模型,另有2項由OpenAI的GPT-5.6 Sol模型實施。
報告強調,在該測試中,研究人員為評估模型的最大能力,有意開放互聯網訪問,並關閉了模型提供商的部分安全機制,模型並未主動逃離隔離環境。不過,在最受關注的OpenAI模型侵入“抱抱臉”公司系統事件中,模型是在測試中一定程度放寬安全限制的情況下,主動發現並利用一個此前未知的漏洞突破隔離測試環境,接入互聯網並實施攻擊行為。
目前的公開信息並沒有顯示這些模型“越界”事件造成大規模數據洩露或持續性破壞,但仍然暴露了一個共同問題:隨著模型能夠自主規劃、調用工具和執行複雜任務,一項配置錯誤就可能把模擬攻擊變成真實入侵。
英國牛津大學研究人員安德魯·索爾坦博士說,類似OpenAI報告的模型“越界”行為,聽起來令人擔憂,但之所以發生,是因為安全護欄被人為關閉了。“這並非AI自行‘失控’,恰恰說明安全保障措施至關重要。”
|