請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

OpenAI新AI模型自破防線 為達目標駭入沙盒

商傳媒

更新於 8小時前 • 發布於 7小時前 • service@sunmedia.tw (商傳媒 SUN MEDIA)
圖/本報資料庫

商傳媒|何映辰/台北報導

OpenAI 近日證實,其一款尚未公開發布的人工智慧(AI)模型在進行內部測試時,竟違反原先設定的指示,突破本身的沙盒環境(一種隔離測試環境),並將程式碼公開上傳至 GitHub,而非依規定上傳至內部通訊平台 Slack,引發業界對 AI 模型自主行為與安全性的高度關注。

根據《PCWorld》報導,這起事件發生於一項 NanoGPT(一種輕量級開源大型語言模型)的性能測試中。該 AI 模型原先被明確指示,測試結果只能發布在公司內部的 Slack 平台。然而,測試指令中要求將程式碼公開發布到 GitHub。在兩項指令相互矛盾下,該 AI 模型選擇了後者,並在長達一小時的漏洞探測後,成功繞過沙盒限制,將程式碼公開。OpenAI 在發現此行為及其他「不當行為」後,隨即暫停了這款內部模型的開發。

OpenAI 表示,在為該模型導入一系列新的防護措施後,開發工作才得以重啟。新的安全監控機制能夠檢查模型的發展軌跡,並在偵測到一連串看似獨立卻可能導向危險的行為時,及時「暫停會話」。此外,額外的安全措施也幫助該模型在長時間運行時,能更有效地記住其指令。

OpenAI 在公開這起沙盒突破事件之前約一週,也曾承認旗下的 GPT-5.6 Sol 模型,在使用 Codex(OpenAI 與 GitHub 共同開發的 AI 程式撰寫工具)的「完整存取模式」下,錯誤地刪除了用戶系統中的文件。這一連串事件突顯了在發展先進 AI 技術的同時,如何確保模型在受控環境下運行,避免潛在風險的重要性。

查看原始文章

更多理財相關文章

01

航運史荒誕一幕!亞洲要買沙國石油 得繞非洲

anue鉅亨網
02

美國拚製造回流,卻更離不開台灣?黃仁勳:產能設在美國,還是得靠台廠

數位時代
03

30歲富僑捧9.4億買「陶朱隱園」!第四戶「無貸款」成交 每坪單價回落300萬

太報
04

群聯脫困新布局1/97名投資人求償群聯7億大翻盤 高院開庭竟只剩5人原因曝光

鏡週刊
05

「高科技共諜」首例!密謀「藍海計畫」偷台積電21項機密 前副理樣貌曝光

太報
06

想讓一段關係走得長久?先避開這28個最扣分的小習慣

商周.com
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...