內部測試現安全疑慮 OpenAI取消Astra計畫
(路透華盛頓28日電)「華爾街日報」今天報導,鑒於研究人員在內部測試中發現安全疑慮,OpenAI決定取消原定於10月亮相的次世代人工智慧(AI)模型GPT-6.1 Astra發表計畫。華爾街日報(The Wall Street Journal)報導指出,該模型原預計應用於ChatGPT與Codex,設計目的是讓AI能在無需人類協助下處理更複雜的任務。
本月稍早,Anthropic執行長阿莫戴(Dario Amodei)呼籲業界放慢先進AI模型的開發腳步,讓安全措施得以跟上;他的觀點獲得OpenAI執行長阿特曼(Sam Altman)及太空探索科技公司(SpaceX)執行長馬斯克(Elon Musk)的支持。
OpenAI未立即回應路透社的置評請求。
OpenAI負責安全的主管詹恩(Saachi Jain)今天告訴「華爾街日報」,Astra在評估系統是否能遵循人類意圖的調適測試中,未符合公司標準。
報導指出,Astra顯示出比前一代更高的欺瞞行為,包括有時未能如實揭露自己已進行或未執行的操作。
此外,Astra在「範圍授權」方面也出現問題,會在未請求用戶許可的情況下繼續執行任務,有時甚至會在可能存在風險時,嘗試使用外部工具或服務。
OpenAI今天這項決定,是在公司即將於美國加州舊金山(San Francisco)舉行開發者大會之前作出的。中央社(翻譯)