OpenAI模型自主攻擊Hugging Face 揭AI失控風險
AI模型出現前所未有的失控行為,OpenAI 21號坦承旗下一個正在接受測試的AI模型,竟然自主突破限制,入侵一家AI新創公司的伺服器,敲響了業界對AI安全跟防護的警鐘。
突破資安測試環境 OpenAI模型驚傳「自主入侵」
據外媒CNN指出,OpenAI一個正接受安全測試的AI模型,在沒有連上網路的情況下,竟然成功脫離了測試環境,並入侵AI新創公司Hugging Face的伺服器,試圖完成測試任務。
OpenAI說明,他們正在測試多種AI模型的組合,其中包括新發布的GPT-5.6 Soul,以及另一款性能更強、還在內部測試階段的模型,該模型正在接受評估,以測試其識別和利用安全漏洞的能力,後續模型自行判斷出,AI新創公司Hugging Face可能掌握著該測試的解決方案,於是它突破了隔離環境的限制,並駭入對方。OpenAI稱之為AI史上前所未有的時刻。
而遭入侵的公司Hugging Face表示,原本就懷疑這起攻擊來自頂尖AI實驗室,沒想到竟然是真的,對於AI能自主入侵感到震驚。
認AI模型測試失控 OpenAI執行長:敲響資安警鐘
CNN AI產業特派員寇德示警,這確實在人工智慧領域的網路安全界敲響了警鐘,AI企業一直警告,這種AI代理可能具備的能力。目前,OpenAI跟Hugging Face正合作進行調查,OpenAI執行長阿特曼也表示,這起事件敲響了資安警鐘,必須加速提升AI模型的安全防護措施。
國際中心/吳嘉恩 編撰 責任編輯/陳筠蓉