700個AI代理聯手入侵Hugging Face 還試圖抹滅痕跡
(路透華盛頓26日電)兩份針對安全漏洞進行的調查報告於週三指出,由OpenAI開發的近700個AI代理在今年7月發動對開源平台Hugging Face的入侵行動,且在許多情況下還試圖「抹滅痕跡」。
這些只需要極少人類監督即可運作的AI 代理,其協同作戰以及事後試圖掩蓋行蹤的行為,讓人們開始質疑AI公司究竟多嚴格地在監控這些日益強大的模型測試,同時也可能為要求更嚴格監管的呼聲「火上加油」。
雖然部分失控行為先前已被披露或暗示,但這兩份報告——一份由OpenAI本身發布,另一份由一組獨立調查人員發表——共同揭露關於這起入侵事件及其前期過程令人吃驚的新細節。
首要細節在於:這起入侵事件並非如先前報導所言僅涉及「單一」失控的AI代理,而是多達約700個AI代理組成龐大的合作蜂群共同行動。
OpenAI僅表示有「多個代理」參與這起入侵,但受邀對該事件進行獨立調查的兩家機構METR與Redwood Research,將該數字定在約700個。OpenAI後續也證實,調查人員提供的這項數據相當準確。中央社(翻譯)