請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

AI 投毒成本低到嚇人:不到 100 美元、一小時搞定,模型越大反而越危險

科技新報

更新於 07月21日15:11 • 發布於 2天前

資安界拋出最新警告!研究指出,當前熱門的「開放權重(Open-weight)AI 模型」不僅容易遭到惡意「投毒」(Poisoning),且攻擊成本極低、幾乎不留痕跡。

曼徹斯特都會大學資安講師暨 Semgrep 資安倡議者 Katie Paxton-Fear 近期完成一項驚人的實測:她僅花費不到 100 美元(約新台幣 3,200 元)、耗時約一小時,就成功利用極少量的惡意訓練資料,在一個可供下載的開放權重程式碼模型中植入了「後門」。

Paxton-Fear 的實驗採漸進式進行。起初,她先進行較溫和的測試,透過「微調」(Fine-tuning)手法試圖改變模型編寫 JavaScript 的命名慣例。結果顯示,即便在指令中明確要求模型維持駝峰式大小寫(camelCase),被動過手腳的模型仍會固執地輸出蛇形命名法(snake_case)。

在確認這套操控手法奏效後,她進一步挑戰底線,僅加入了 10 筆被污染的訓練樣本。這項微小的變動,竟讓該模型開始穩定產出帶有「遠端程式碼執行」(RCE)漏洞的程式碼,這意味著,不知情的開發者若採用了這些程式碼,駭客就能輕易在受害者的電腦上遠端執行惡意指令。

這項實驗凸顯了 AI 領域目前最棘手的盲點:我們幾乎沒有可靠的技術,能判斷一個模型是否已經遭到竄改。 與傳統軟體不同,AI 模型的內部運作宛如黑箱,即便是公開權重的模型,資安人員也無法像過去那樣透過完整的「逆向工程」來掌握其行為模式;另一方面,商用的封閉模型雖然不公開權重,但使用者同樣必須承擔極高的「信任成本」,且對其內部決策機制幾乎一無所知。

令人意外的是,Paxton-Fear 的實驗揭露了一個反直覺的現象:規模越龐大的 AI 模型,遭受投毒的風險反而更高。

這項發現與業界先前的警告不謀而合。知名 AI 企業 Anthropic 聯合英國 AI 安全機構與艾倫圖靈研究所(Alan Turing Institute)的研究就曾指出,只需植入數百份惡意文件,就足以徹底污染這類大型系統。

研究人員對此發出嚴正警告:被投毒的 AI 模型表面上看起來可能運作正常,卻會在無人察覺的暗處悄悄改變決策邏輯。在不知情的狀況下,過度依賴並盲目信任 AI,將讓使用者暴露在難以預料的資安風險之中。

(首圖來源:shutterstock)

立刻加入《科技新報》LINE 官方帳號,全方位科技產業新知一手掌握!

查看原始文章

更多理財相關文章

01

黃仁勳啟用X帳號迅速圈粉 首帖暢談AI發展理念

中央通訊社
02

最低21元中獎!3-4月發票中千萬6人還沒來領

NOWNEWS今日新聞
03

雷虎、尚茂等7/27打入處置 聯亞等42檔列入注意股

自由電子報
04

致癌油新進度3/損失破億忙跟客戶協商 問題油品通通拿去做「這個」

鏡週刊
05

平息致癌油風暴!中聯油脂3大股東掛保證 疑慮未釐清前不會復工

自由電子報
06

下周台股反攻有望?美國科技巨頭傳好消息 台指期夜盤一度勁揚近500點

民視新聞網
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...