AI 也搞駭客攻擊? Anthropic承認旗下產品入侵3目標
Newtalk新聞
近年來,人工智慧( AI )技術持續發展,越來越多 AI 工具進入了人們的日常生活之中,各大科技企業在相關領域取得的突破也成為了全球民眾的關注焦點。近期有消息稱, Anthropic 承認旗下 AI 語言模型在進行網路安全測試時,曾在未經許可的情況下,訪問了三個不同機構的網際網路設施。雖然 Anthropic 聲稱旗下 AI 模型在意識到身處開放網路環境後隨即停止駭客攻擊,但相關事件仍引發部分民眾對 AI 技術可能造成危害的擔憂情緒。
根據美國《有線電視新聞網》( CNN )報導,當地時間 30 日, Anthropic 發布公開聲明,承認旗下 AI 模型犯下了與 OpenAI 相同的錯誤:在網路安全測試中入侵了三個分屬不同組織的系統。該聲明表示,在 OpenAI 公開承認 AI 系統曾在網路安全測試期間逃出測試環境後,公司對旗下 AI 系統的測試報告進行了嚴格的審查,最後在 14 萬份評估報告中發現了 3 起入侵開放網路實體的案例。
聲明稱,在這三起入侵事件中,公司要求被測試的 AI 模型進行虛假的「奪旗」挑戰,找出、入侵並奪回被隱藏在網路中的旗幟。 Anthropic 指出,在入侵這三個位於公開網際網路中的對象時,旗下 AI 模型使用包含「利用弱密碼」、尋找無須登入的系統入口點等多項基本技術。
但 Anthropic 強調,旗下 AI 模型並不存在「故意」逃離測試環境的意圖,只是該公司與合作夥伴之間的「誤會」讓 AI 模型獲得了訪問開放網際網路的權限。 Anthropic 也進一步表示,當旗下 AI 模型意識到自身正處於開放網路環境中時,就停止了相關的駭客攻擊行動,宣稱所有遭受影響的組織「都沒有意識到自己遭到駭客攻擊」。
即使 Anthropic 宣稱相關駭客行動並沒有造成大規模的傷害,但接連發生的 AI 入侵公開網際網路實體的事件也引發許多專家、學者的擔憂。報導稱,具有高級網路安全技能的 AI 如果逃離人類掌控的測試環境,極可能對現實世界造成巨大的危害。
最後, Anthropic 宣布停止所有的網路安全評估測試活動,承諾將採取更深入的防護措施,避免類似事件再度發生。但該報導認為, AI 代理商「在無意中入侵其他組織」的事件可能不只發生在 OpenAI 以及 Anthropic 等兩間公司,呼籲相關企業加強對 AI 測試環境的保障,並適度減緩 AI 的發展速度,「目前 AI 的發展速度已經遠遠超過了我們這個社會所能承受的適應上限」。