Google 正在開發代號 Frozen v2 的新款 AI 推論晶片,預計 2028 年部署於自家資料中心,目標是大幅提升 Gemini 系列模型的運算效率並降低每 token 成本。

重點

  • 模型架構固化入晶片:Frozen v2 將 Gemini 模型部分架構直接嵌入矽晶片硬體(frozen),減少每次推論時的動態運算次數與晶片內部資料搬移量
  • 效率大幅提升:Google 工程師預估,相同電力消耗下,Frozen v2 可處理的 token 數量將遠超現有 Google 自研 AI 晶片
  • 降低對 NVIDIA 依賴:消息一出帶動 Alphabet 股價上漲,市場解讀為 Google 加速自研晶片路線,縮減對 NVIDIA GPU 採購量

編輯按

Frozen v2 代表 Google「模型 + 晶片」深度垂直整合的關鍵一步:不只訓練模型,更為特定模型量身打造推論硬體。這種策略可大幅壓低推論成本、提升競爭力,但也意味著模型架構一旦重大改版,晶片設計便難以複用。2028 年能否如期量產,將是觀察重點。

本文由 AI 整理,原文:TechNews 科技新報