為甚麼NVIDIA要自己下場開發大模型?
現在的「開源模型」,DeepSeek、Qwen、Kimi、GLM、Nemotron,越來越多,一個比一個強,還全都可以讓你免費下載。
照理說,訓練一個頂級模型要燒幾億美元,這應該是被鎖起來收錢的鎮店之寶。但現在,大家卻搶著把它免費送給全世界。
你有沒有想過,如果開放模型免費下載,那誰在賺錢?
答案是,「免費」本身,就是生意的一部分。
模型這一層,正在被「戰略性商品化」。巨頭寧願把智力變成免費的空氣,也要把價值逼到別的地方去。那錢,到底從哪幾個口袋來?
1. 賣省事。
模型免費,但自己架伺服器很折騰。
於是實驗室賣最便宜、最快的官方 API。多數開發者試了一圈,發現付錢調用反而比自己養一台機器划算。
2. 賣企業安心。
個人下載免費,但大企業要私有部署、24 小時維運、合規保證,就得付昂貴的企業授權。
3/ 母公司買單。
Meta 免費開 Llama,是為了不讓任何人壟斷底層智力;阿里巴巴免費開 Qwen,是為了把開發者拉進自己的雲。模型研發的幾億美元,對它們而言只是帶動本業的行銷費。
4/ 免費的全球研發團隊。
模型一開放,百萬工程師免費幫你找 bug、修漏洞、給真實反饋。實驗室省下天價的測試成本,迭代速度反而更快。
不過,最深、也最精明的一層,是「賣鏟人」的誘餌。
就在昨天(8月11日),NVIDIA 發布了開源模型 Nemotron 3.5 Lightning 和路由工具 NeMo Switchyard。
NVIDIA 免費發 Nemotron,從來不是做公益,也不是為了跟 GPT 或 Claude 比拼「誰更聰明」。
這款模型(30B 參數,實際調用 3B)是專門為 Agent(自主代理)系統設計的「執行工人」。
未來的 AI 架構不再是單一超大模型包辦一切,而是「大模型負責思考規劃,小模型負責海量執行」。
NVIDIA 把這個高效、專門針對自家硬體深度優化的執行模型免費送出去,再搭配 Switchyard 讓企業自動把任務路由給最合適的模型。
結果是什麼? 每一家下載開源模型、決定在自己機房部署 Agent 的企業,為了支撐龐大的執行任務量,最後都必須買 NVIDIA 的 GPU、跑 NVIDIA 的 CUDA。
我在最新一期的深入分析中,詳細解釋了「主權AI」和「開源AI」的邏輯,在這個全新的產業鏈中,誰會受惠。
誠邀你閱讀全文,鏈結在此。
- KP