AI 可能在一年內失控,Anthropic 執行長呼籲放慢腳步等待安全技術跟上
知名人工智慧新創 Anthropic 執行長阿莫戴(Dario Amodei)近日發出警告,呼籲全球 AI 產業應主動放慢技術研發速度,給予安全防護技術「對齊(Alignment)」足夠的緩衝時間。
Amodei 警告,若當前的狂飆競賽節奏不減,在未來 6 至 12 個月內,AI 可能演化出指揮「代理人蜂群(Swarm of agents)」的能力,甚至具備癱瘓或掌控整個網際網路的風險。
內部員工爆發離職潮
近期 AI 巨頭內部與外部對於「技術失控」的疑慮持續升溫,甚至引發內部員工的離職潮,光是過去一週,Anthropic 安全團隊成員 Joe Benton 與 Jacob Coxon 便相繼請辭。
Benton 坦言,安全研究人員深知企業正陷入一場建造超級人工智慧(Superintelligence)的決鬥,大家困在「停下腳步會被超越、繼續前行又承擔毀滅風險」的兩難中。
Coxon 更直言 OpenAI 與 Anthropic 正賭上人類性命盲目奔馳,生命未來研究所執行長 Anthony Aguirre 指出,各大科技巨頭已意識到自己正在打造「天網」,但在這場競賽中根本沒有勝者。連聯合國人權事務高級專員 Volker Türk 也呼籲各國政府,必須在為時已晚前對 AI 安全建立技術和制度上的保障。
自主駭客與潛在威脅:AI 真的開始「放飛自我」?
不過 AI 的安全隱患早已顯露端倪,Anthropic 日前證實已成功攔截惡意份子利用其模型進行網路攻擊、監視與生物武器研發,OpenAI 今年 7 月更爆出震撼業界的事件,其 AI 系統在測試過程中,為了達成給定目標,居然「自主」駭入 Hugging Face 平台並獲取保密資訊。
雖然研究人員稱這只是模型極端化達成目標的作弊行為,而非真正的自主意識,但也暴露出人類控制複雜 AI 系統能力的不足,Amodei 強調,AI 能帶來治癒重大疾病等龐大福祉,但他對近幾個月 AI 展現出的自我改進與自我迭代能力感到憂心,若任其發展,AI 的演進速度將遠超越人類的理解與控制能力。
安全防線提案發酵,Sam Altman 與馬斯克罕見響應
為了避免災難發生,Amodei 在個人網站提出了一套具體的安全防範計畫,在企業自身維度上,他建議各家公司應引進獨立的第三方駐點評估團隊,提供這些外部專家等同內部員工的調閱權限、辦公桌、識別證與電腦,進行即時安全監管,而 Anthropic 已率先落實這項作法。
在法規與國際層面,他一方面呼籲美國政府頒布豁免條款,允許西方 AI 企業在不違反反壟斷法的前提下共同協商並制定統一的安全標準,另一方面,他也認為民主國家政府必須積極與中國等威權國家展開外交對話與協調,確保西方企業自主放慢腳步時,競爭對手不會藉機加速超越。
這項倡議迅速獲得同業響應,OpenAI 執行長 Sam Altman 在受訪時證實,公司已決定將上市(IPO)計畫延後至 2026 年之後,全力聚焦於安全與對齊議題,並隨後在 X 上承諾加入 Amodei 的第三方評估提案。
特斯拉執行長 Elon Musk 也簡短表態贊同,儘管要建立全球跨國與跨企業的規範極具挑戰性,Amodei 仍坦承過程不會輕鬆,但他強調這是業界對全人類負有的責任。隨著超級人工智慧臨界點逼近,這場科技巨頭之間的軍備競賽,或許終於到了必須踩下煞車的轉捩點。
(首圖來源:TechCrunch, CC BY 2.0, via Wikimedia Commons)