請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

Anthropic推Opus 5.5:性能追平Fable 5.1、成本降四成,安全測試分數創新高

TVBS

更新於 1天前 • 發布於 1天前 • 黎怡涵 新聞中心
Anthropic推Opus 5.5,成本降四成。(圖/翻攝自Anthropic官網)

Anthropic 9月22日推出Claude Opus 5.5,作為Claude 5.5系列首款人工智慧(AI)模型,主打程式設計、電腦操作及知識工作能力,同時加強資安防護。Anthropic表示,Opus 5.5在多數工作上的表現與Claude Fable 5.1相當,但運行成本較上一代Opus 5降低40%。

強化AI代理安全防護

Anthropic指出,Opus 5.5在涵蓋近2000種模擬情境的自動化行為稽核中,表現優於近期Claude模型。在測試模型是否會突破限制方面,Opus 5.5試圖繞過測試環境邊界的次數,比Opus 5及Claude Mythos 5.1少約85%,且每次嘗試的嚴重程度都較低,並由模型主動回報。

Anthropic表示,Opus 5.5發布前接受Frontier Design及METR等外部機構的測試。由於模型具備較強的資安及生物學能力,公司也採用與Fable 5.1相近的防護措施,其中部分資安請求會轉交Opus 4.8處理;符合資格的生物及資安研究機構與專業人士,則可申請相關驗證計畫。

程式設計與知識工作提升

Anthropic表示,Opus 5.5特別適合處理大型程式碼遷移及稽核工作。早期測試者曾使用模型,在不到一天內完成68萬行程式碼遷移;另一項測試中,Opus 5.5在3小時內完成20萬行程式碼的檢查與修正,Opus 5則花費超過20小時。

在知識工作方面,Anthropic測試Opus 5.5、Fable 5.1及Opus 5撰寫企業財報分析報告,要求模型自行搜尋資料並核對數據與引述。18份Opus 5.5報告中有16份達到公司的品質標準,其他兩款模型則沒有任何一次達標。另一項模擬企業併購的測試中,Opus 5.5也能建立Excel財務模型及簡報,完成時間較Opus 5縮短約30分鐘,成本降低50%。

降低成本並加強防蒸餾

Opus 5.5每百萬輸入及輸出token分別收費4美元及20美元,快取讀取則為0.20美元;輸出速度也比Opus 5快逾30%。Anthropic同時提高部分付費方案的5小時使用上限,並新增可由訂閱用戶自行保存及使用的速率限制重設功能。

針對透過大量帳號擷取AI模型能力的「蒸餾(distillation)」攻擊,Opus 5.5延續Fable 5.1推出的preserved thinking機制,限制API使用者修改Claude先前的上下文,以降低透過此方式擷取模型推理能力的風險。Anthropic表示,Claude Sonnet 5.5及Haiku 5.5預計在未來幾週推出。

立即加入《TVBS娛樂頭條》LINE官方帳號,給你滿出來的八卦和娛樂大小事!

查看原始文章

更多理財相關文章

01

【連假必玩】小兵立大功!每年預算僅1000萬卻創造67億產值 全國觀光工廠有多厲害?

太報
02

台商大遷徙2》三角貿易式微 台灣生產超越中國

自由電子報
03

存800萬「買3檔ETF」…就能月領7.1萬躺平?達人曝2大致命盲點

鏡報
04

延後退休潮1/65歲勞保不用「畢業」!繼續工作年資照累積 晚領最高多20%

鏡週刊
05

錢鏡你家1/台股8萬點、台積電5000元?  杜金龍揭多頭2階段時間表

鏡週刊
06

快對獎!7-8月統一發票千萬獎「89996565」 完整獎號在這裡

自由電子報
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...