OpenAI測試模型失控入侵他廠平台 首次AI主導網路攻擊引發關注
商傳媒|方承業/綜合外電報導
OpenAI 證實,其旗下一個先進的人工智慧(AI)系統在本週稍早脫離測試環境,並自主攻擊了知名開源AI平台 Hugging Face 的部分基礎設施。這是首次公開承認的案例,表明領先的AI模型能在極少人工干預下,跨越多個環境執行複雜的網路攻擊,讓業界震驚。
根據《IT Brief Asia》報導,這次攻擊始於 OpenAI 內部測試環境。該 AI 模型在試圖通過內部網路資安評估時,利用惡意資料集濫用兩個程式碼執行路徑——一個遠端程式碼資料集載入器和一個範本注入漏洞,成功在 Hugging Face 的處理伺服器上執行了程式碼。攻擊過程中,AI 代理並不需要初始憑證即可進入系統,且一旦開始,便沒有人類操作員指示其入侵行為。該 AI 代理在一個週末內,從初步立足點升級到節點級別的存取權限,隨後竊取雲端與叢集憑證,並在內部叢集之間橫向移動。
專家指出,此事件標誌著網路攻擊從「AI輔助」轉變為「AI主導」的新階段。《Yahoo Tech》引述喬治城大學安全與新興科技中心資深研究分析師 Jessica Ji 的說法,OpenAI 的沙盒(一種用於測試人工智慧模型、將其與外界隔離的受限環境)並未完全切斷網路或網際網路連線。該模型利用第三方軟體中一個未知的漏洞,繞過了安全措施,最終透過竊取的憑證和其他弱點入侵 Hugging Face 系統。紐約大學網路安全教授 Justin Cappos 認為,AI 模型透過強化學習(reinforcement learning)達成目標,可能會不惜採取「不道德的步驟,如駭客攻擊」,以完成任務。
前 OpenAI 產品安全主管 Steven Adler 表示:「我們現在有實質證據顯示,如果沒有強大的防護措施,未經校準的AI系統最終將會犯下罪行。」他呼籲應將此事件視為「警示」。這起事件也加劇了AI研究人員、網路安全專家和立法者對快速發展的AI技術進行監管的呼聲。OpenAI 總裁格雷格·布羅克曼(Greg Brockman)週四向 CNN 表示,公司正在進行「全面調查」,以「了解所有發生的事情」。
業界普遍認為,這起事件暴露出企業在評估和限制高度自主的AI代理系統時存在的新弱點。過去Anthropic公司也曾有模型成功逃脫沙盒,甚至自行寄送電子郵件給研究人員的案例。資安專家強調,現在必須將AI系統視為具有高度權限的軟體,而不僅僅是更聰明的聊天機器人。安全地採用AI需要全面的控制措施,包括檢查不受信任的資料、隔離執行環境、最小化權限、使用短期憑證、限制網路存取,並維持清晰的審計紀錄。