傳 Google 開發 Gemini 專用 AI 晶片!運算效率狂飆 10 倍
記者黃肇祥/綜合報導
為了加快 Gemini 運算效能、滿足算力需求,據傳 Google 正在開發一款代號為「Frozen v2」的 AI 伺服器晶片,得以帶來最高 10 倍的效率成長,最快將在 2028 年完成部署。
外媒《The Information》報導指出,Google 將推出 Frozen v2 晶片,旨在更有效率地運行 Gemini 模型,有別於單純提升算力,Frozen v2 是直接將 Gemini 模型的部分框架嵌入在晶片裡,減少資料的運輸量。Google 內部工程師預估,在相同電力單位下,Frozen v2 晶片能處理的 Token 數量會是現行 TPU 的 6~10 倍。
消息表示,為了達到高速運算, Frozen v2 必須犧牲一點靈活性,恐迫使 Google 得長時間維持相同的 Gemini 模型架構,否則後續產品將會出現支援性問題。因此 Google 將 Frozen v2 視為自研晶片的專業分支,目標並非取代通用的 TPU,暫時僅作為實驗項目,並沒有大規模生產的計劃。
在 Google 官方聲明也提到,團隊持續探索創新,以提升效能與效率,不是所有專案都會進入量產,會透過軟硬體的共同設計,確保系統能夠有效整合,且對實際工作帶來最佳化表現。
Frozen v2 表定將在 2028 年正式上線,旨在解決目前緊繃的 AI 算力。畢竟上個月,Google 才每月 9.2 億美元、合計 3 年 300 億美元的合約,向 SpaceX 租借約 11 萬張 NVIDIA GPU 的算力,顯見算力的明顯不足。