
科技巨頭Google傳出正開發一款代號「Frozen v2」嘅全新伺服器晶片,專門提升旗下人工智能模型Gemini嘅運算效率。美國科技媒體The Information周一引述知情人士報道,呢款晶片會將Gemini模型架構嘅部分內容,直接同永久咁嵌入矽片硬件之中,從而減少回答用戶查詢時所需嘅運算次數,以及晶片內部需要搬移嘅資料量。Google工程師估計,喺相同耗電量之下,新晶片可處理嘅詞元(token)數量,將係Google最新張量處理單元(TPU)嘅6至10倍,公司目標2028年開始部署。「Frozen」呢個名,據報同AI界「凍結」(freeze)模型參數嘅講法一脈相承,意指將部分結構鎖定唔再改動。
報道指,Frozen v2並唔係要取代用途較廣泛嘅TPU,而係Google訂製晶片產品線入面一個更專門嘅分支,產量預計遠低於TPU,項目暫時帶有試驗性質。呢種設計嘅代價係犧牲彈性:由於部分模型結構已經「寫死」入矽片,晶片日後只可以支援沿用相同基礎架構嘅Gemini版本。另有報道引述消息指,構思最初源自Google DeepMind首席科學家迪恩(Jeff Dean),第一代設計原擬連模型權重都直接嵌入晶片,但因為只能配合單一Gemini版本、好快就會過時而被擱置;v2改為嵌入模型架構,權重仍然可以更新,至於最終有幾多內容會「硬編碼」入晶片,據報內部仍未拍板。
The Information又披露,項目部分係為咗紓緩Google內部嚴重嘅AI算力荒,缺口大到令Google Cloud要推卻部分外部客戶生意,並喺公司內部引發磨擦;外界亦一直視Google自研晶片為減少依賴英偉達(Nvidia)嘅策略一環。有分析指,運行AI模型成本極高,數據中心每慳一瓦電都係錢,專為單一模型度身訂造嘅晶片,有望大幅削減通用晶片嘅額外開銷。Google母公司Alphabet回應時無證實亦無否認,僅表示團隊「持續研究並測試各種新技術,為用戶同客戶提供最高嘅效能同效率」,又強調「雖然唔係每項計劃最終都會投產,但嚴謹探索係我哋全端式技術策略嘅核心」。