AI 戰場新風向:不拚「最聰明」拚「最划算」,高性價比中階模型成企業新寵
AI 模型市場正從「比誰更強」轉向「比誰更划算」。根據最新整理,前沿旗艦模型仍由 Anthropic、OpenAI 等業者領跑,但在實際使用與成本效率上,中階模型正快速逼近,甚至成為企業與開發者更常採用的選項。
在能力表現上,Anthropic 的 Claude Fable 5.1、Claude Opus 5 仍位居多項榜單前段,OpenAI 的 GPT 5.6 Sol、xAI 的 Grok 4.6,以及中國廠商的 Kimi K3、DeepSeek 系列也緊追在後。不過,這些頂級模型的價格依舊高昂;以 Fable 5.1 為例,單次任務成本仍達 3.69 美元左右,即使 cache 寫入價格下調 75%,整體使用成本仍遠高於中階產品。
相較之下,Google 的 Gemini 3.8 Flash、OpenAI 的 GPT 5.6 Sol(high)、Meta 的 Muse Spark 1.3,以及 DeepSeek、Z.ai 等中國模型,則在維持不錯智慧分數的同時,將價格壓到更低。以 Gemini 3.8 Flash 為例,其智慧分數約 59,單次任務成本僅 0.58 美元,約為 Claude Fable 5.1 的六分之一;Meta 的 Muse Spark 1.3(xhigh)則以 61 分、0.55 美元的組合,暫居 Pareto frontier 位置,但這個冠軍只維持了 3.5 小時就被 Gemini 3.8 Flash 取代。
Gemini 3.8 held a spot at the pareto frontier for *checks notes* 3.5 hours https://t.co/P1A46LAy1M
— Florian Brand (@xeophon) September 2, 2026
價格下探也帶來使用量暴增。OpenRouter 工程師公布的圖表顯示,整體付費 token 使用量在過去一年增加 25 倍,近一個月又翻倍。最常被使用的模型之一,是 OpenAI 的 GPT 5.6 Luna,單月接近 12 兆 tokens;緊追其後的是中國 Z.ai 的 GLM 5.3 Flash,單月約 11.4 兆 tokens,月增幅超過 1,000%。相較之下,昂貴的旗艦模型使用量明顯偏低,Claude Fable 5 的月輸出 token 只有數十億級,OpenAI 的高價模型月使用量也僅約 1.8 兆 tokens。
very normal month of token growth nothing to see here pic.twitter.com/V2huOmNcYK
— Toven (@pingToven) August 31, 2026
這波變化也反映出企業對 AI 的態度正在轉變:一方面希望大規模導入,另一方面又迅速意識到成本失控的風險。Uber 曾在幾個月內燒掉年度 AI 預算,另有公司在短短數週內消耗價值 5 億美元的 tokens。如今,市場更清楚地顯示,真正決定採用與否的,不只是模型分數,而是每次任務能否以足夠低的價格完成。
(首圖來源:shutterstock)