請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

OpenAI 加強「防護圍欄」:暫停大規模強化學習訓練,嚴防 AI 脫軌風險

科技新報

更新於 08月19日09:56 • 發布於 08月19日10:30

OpenAI 18 日宣布,模型測試與開發流程將推出新安全措施,重點放在更細節監控、加強後訓練階段同步與安全要求,以及更嚴格的網路隔離,降低模型內測時可能引發的資安風險。

OpenAI 表示,模型提升後,開發與測試風險也同步升高,因此監測、資料同步與安全標準必須持續提高。公司強調,這些調整並非單純因 Hugging Face 事件,但事件後與即將推出的 Astra 模型展現的資安功能,都讓 OpenAI 更快速推動防護。

OpenAI 說,Hugging Face 事件發生後,公司暫停兩週強化學習訓練,之後才恢復部分風險較低的模型訓練。不過,最大規模的尖端 RL 訓練仍暫停,OpenAI 會先以較小規模的訓練與評估來檢驗模型行為、驗證防護措施,並累積更多證據後再往前推進。

新制度下,OpenAI 將對高風險模型採取更嚴格的分級管理,模型越強大,審查也會越嚴。公司同時強化研究環境的沙盒與網路隔離,避免單一工作負載或支援服務遭入侵後,就能直接取得外網或其他內網的存取權限。

最受關注的是新監控系統。OpenAI 表示,系統會檢查工具操作、可用推理痕跡與活動紀錄,偵測未授權行為,目標是 30 分鐘內警告。公司估計,這套監控機制本身約會造成 20% 運算負擔,之後會公布更多細節。

(首圖來源:AI)

立刻加入《科技新報》LINE 官方帳號,全方位科技產業新知一手掌握!

查看原始文章

更多理財相關文章

01

AI衝擊底層零工!ChatGPT摧毀肯亞4萬人論文代寫產業,為何「AI痕跡抹除工」訂單卻接不完?

數位時代
02

欣興:「欣興一」達公布注意交易資訊標準,最新轉交換價格163.8元

MoneyDJ理財網
03

Google台灣驚傳大裁員?各組「大砍5成」官方回應了

EBC 東森新聞
04

寧死也不買外帶咖啡! 女富豪揭驚人數字:你喝掉的是「3000萬退休金」

鏡週刊
05

信驊、鴻勁、致茂…高價股爆發領台股衝破47000!大立光為何跌停?台達電也傳雜音,現在能買嗎?

今周刊
06

台股重返四萬七收史上次高 台股今年反超韓股登亞股強漲王

太報
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...