中國AI競賽再升級 阿裡巴巴推出最新模型
(德國之聲中文網)中國科技巨頭阿裡巴巴週一(8月3日)發布了旗下功能最強大的人工智慧模型「通義千問3.8-Max」( Qwen3.8-Max),隨後迅速登上多個AI模型能力排行榜前列,也帶動該公司在香港的股票上漲7%。
該模型擁有2.4兆個參數,參數是模型從資料中學習得來的數值設定,用於辨識模式、生成答案並執行各項任務。
路透社報導稱,「通義千問3.8-Max」的規模已接近中國競爭對手「月之暗面」(Moonshot AI)上個月推出、擁有2.8兆個參數的AI模型Kimi K3。
儘管參數數量增加並不一定代表模型更優秀,但參數規模已成為衡量先進AI系統背後運算能力與資料規模的重要指標。
「通義千問3.8-Max」週一在線上AI模型評測與盲測平台「Arena.AI」上亮相,隨後迅速成為該平台文字模型排行榜中排名最高的中國模型,但仍落後於美國人工智慧新創企業Anthropic的Claude Fable 5以及三個Opus版本模型。
在用於分析圖片及其他視覺內容的視覺能力排行榜中,「通義千問3.8-Max」位居全球第二,僅次於Claude Fable 5的一個版本。
路透社指出,「通義千問3.8-Max」與Kimi K3均可同時處理文字、圖片與影片,並1次處理最高達100萬個「詞元」(Token)。詞元數量越大,代表模型能1次讀取的資訊越多。
阿裡巴巴表示,Qwen3.8-Max採用了「混合專家模型」(Mixture-of-Experts,MoE)架構,透過將工作分配給不同的專業模組,而非每次都啟動整個模型來完成運算。因此,模型雖然總共有2.4兆個參數,但每次運行實際只啟用約950億個參數,從而降低運算成本與回應延遲。
阿裡巴巴指出,「通義千問3.8-Max」預計下週透過「阿裡雲」(Alibaba Cloud)的「Model Studio」平台正式發布,並稱該模型曾在16天內完成1項軟體工程專案。
DeepSeek續打低價戰
隨著美中AI戰場持續,中國AI新創「深度求索」(DeepSeek)在上週五(7月31日)發布的新模型V4-Flash也持續採用低成本戰略。
研究機構Artificial Analysis評估顯示,V4-Flash當前是全球知名AI模型中,運行成本最低的模型之一,而且遠低於多數競爭產品。
路透社引述知情人士說法指,DeepSeek正在為首次公開募股(IPO)做準備。該公司於2025年初推出的R1與V3模型曾引發全球轟動,不僅造成美國科技股遭到拋售,也引發外界對美國企業在AI領域是否非得投入巨額資金的討論。
Artificial Analysis數據顯示,V4-Flash每100萬個輸入詞元收費0.14美元,每100萬個輸出詞元收費0.28美元。
該平台估算,V4-Flash完成每項基準測試的平均成本約為0.03美元;月之暗面的Kimi K3為0.86美元,OpenAI的GPT-5.6 Sol為1.86美元,Anthropic的Claude Fable 5則為3.15美元。
研究機構指出,單看定價未必能反映模型的實際價值。由於完成任務所需處理的資料量與運算步驟存在差異,即便有些模型看似價格較低,但若需要更多運算才能產生結果,最終成本反而可能更高。
中國企業押注 「開放權重」
值得注意的是,不論是阿裡巴巴的「通義千問3.8-Max」與還是DeepSeek的V4-Flash,都反映出中國企業持續著重於「開放權重」(open-weight)模型,希望藉此吸引更多全球開發者使用其技術。
研究機構Omdia首席分析師蘇連傑(Lian Jye Su)表示:「中國AI企業已找到一個重要市場」,並指出許多企業的應用場景實際上並不需要業界最頂尖的模型,而是「性能夠、價格合理、透明且容易取得的模型,而開放權重模型正好能滿足這類需求。」
「開放權重」模型指的是,開發者可以下載模型的核心參數,並自行調整模型。相較之下,OpenAI、Anthropic及Google採用的則是封閉式模型。
DW中文有Instagram!歡迎搜尋dw.chinese,看更多深入淺出的圖文與影音報導。
© 2026年德國之聲版權聲明:本文所有內容受到著作權法保護,如無德國之聲特別授權,不得擅自使用。任何不當行為都將導致追償,並受到刑事追究。