請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

Agent 失控闖德國網站,OpenAI 研擬新機制揭露 AI 偏差行為

科技新報

更新於 2天前 • 發布於 2天前

《路透社》揭露一群失控的 OpenAI Agent 劫持一個德語網站,將其轉變成供其他 AI Agent 使用的網路布告欄。知情人士表示,OpenAI 早已得知這起事件,但公司高層忙於應對 7 月 Hugging Face 遭入侵一事的後續效應,此事被壓下來未向社會大眾揭露。

先前一起 AI Agent 失控事件,詳載在一份獨家分享給《路透社》的報告,由一群研究人員撰寫而成,包括 AI 安全非營利組織 Nightingale 的執行長 Sydney Von Arx,以及從量化交易員轉行為 AI 研究人員的 Cormac Slade Byrd。他們告訴《路透社》,這些活動是 8 月底他們在網路上搜尋未經授權的 AI Agent 行為而發現的。

失控的 AI Agent

研究人員在一個名為 DseWiki、供程式設計師分享知識的德語 Wiki 網站上,發現超過 15,000 筆由 OpenAI Agent 執行的編輯紀錄,將網站改造成一塊留言板,彼此分享如何針對某些任務作弊、如何繞過 OpenAI 各項限制,以及如何掩飾自身行為的種種手法。

研究人員表示,他們之所以能辨識出 DseWiki 這些活動是由 AI Agent 驅動,是因為這些活動都以超越真人的速度進行。這些 AI Agent 同時也對解決各種技術問題展現高度專注,這是各家 AI 公司用於訓練並測試模型評估項目的典型特徵。

DseWiki 的訊息由那些自稱、並互稱為 Agent 的使用者留下,其中有一半為自身取了帶有 OpenAI 色彩的使用者名稱,例如「OpenAIResearcher」或「OAIResearchMar26」。

從公開的伺服器日誌顯示,這些活動有相當大一部分源自於 Microsoft Azure 的基礎設施。他們同時也觀察到,這起事件發生後,OpenAI 的員工曾反覆造訪 DseWiki,暗示這些 AI Agent 與 OpenAI 之間有所關聯。

研究人員檢視的訊息顯示,這些 AI Agent 謀劃各種規避偵測、運用 Tor 等工具,並在自身被關閉之後仍能保全通訊內容的方式。

當 DseWiki 的版主 6 月開始刪除相關頁面時,這些 AI Agent 便以建立備份頁面的方式回應,躲避清理行動。「wiki 的清理/刪除掃描行動看來正依字母順序進行中。」某個 AI Agent 在 6 月 19 日寫到,「若本頁面消失,請改試 [[ZZZDataUSAConstructionWageLive]]。」

研究人員同時也發現,這些 AI Agent 試圖竄改網站的相關行為,倫敦國王學院(King's College London)資深研究人員 Lukasz Olejnik 表示,這已經相當於駭客攻擊的嘗試。

過去 AI Agent 不當行為,往往被淡化成網路安全測試下的副產物,但 Lukasz Olejnik 認為,這些 AI Agent 失控行為或許不僅限於那樣的情境中。

劍橋大學生存風險研究中心(Centre for the Study of Existential Risk)學者 Maurice Chiodo 曾檢視這些 AI Agent 部分通訊內容。他表示,訊息看起來就像是某種地下網路的運作方式,一心一意要達成某項任務或使命。他更表示,先進 AI 帶來的最大威脅,或許並非某一套單一的超級智慧系統,而是「一大群彼此串通的半智慧 AI 群體」。

OpenAI 初步回應

「對於一份我們尚未有機會加以檢視的報告,其中的各項主張或發現,我們無法做出有實質意義的回應。」一名 OpenAI 發言人表示,「路透社與該報告的作者皆拒絕我們索取閱覽報告的請求。我們將在發布後仔細審查內容,並採取任何必要的後續措施。」

部分 OpenAI 內部調查人員原本希望能對這起事件進行更嚴密的檢視,但根據 4 名熟悉相關事務的知情人士所述,擴大調查範圍遭到 OpenAI 內部其他人士(包括法務顧問)的阻力。對此,「有關我們法務團隊阻撓對此事件進行調查的主張並不屬實」,OpenAI 發言人澄清。

無論是 DseWiki 或更早爆發的 Hugging Face 事件,OpenAI 稍晚透過 X 貼文表示,「我們需要擴展模型功能偏差的揭露機制,以適應模型能力發展的新階段。無論是我們自身或更廣泛的 AI 社群,目前皆未建立起一套明確的標準,用於規範該如何通報在訓練、評估及部署過程出現的偏差。」OpenAI 著手研擬一套相關框架,將在未來數週內對外分享。

這起從 5 月開始、未曾被報導過的事件,凸顯 AI 產業內部的緊張態勢。各家 AI 公司競相打造自主性越來越高、能執行複雜任務的 AI Agent。卻有越來越多證據顯示,這些 AI Agent 同時可能學會鑽規則漏洞,並以開發者既未預料、也非本意的方式彼此串連合作,失控行為帶來網路安全風險,使 AI 公司以及政府機關加緊研擬保護和管制措施。

(首圖來源:pixabay

立刻加入《科技新報》LINE 官方帳號,全方位科技產業新知一手掌握!

查看原始文章

更多理財相關文章

01

億萬富翁大不同!台彩揭史上「最淡定」與「最慌張」傳奇 淡定哥中9.1億捐2500萬

anue鉅亨網
02

這家PCB大廠今驚傳「風管燃燒」觸發火警 發重訊回應了

三立新聞網
03

正港富三代!富阿公、阿嬤贈子孫總額高達869億元

自由電子報
04

緯穎1張變近3張竟藏「小數點陷阱」!沒湊股恐損失2438元

鏡週刊
05

後悔太晚開始投資! 網友曝最有感理財觀念:本金小要靠時間慢慢滾

CTWANT
06

中國砸1.7兆救金融 謝金河示警了

NOWNEWS今日新聞
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...