2026-07-21 03:29:29
Google 計畫推出凍結 v2 AI 晶片以嵌入 Gemini 架構,可能在 2028 年前將推論效率提升 6-10 倍
根據 Beating,Google 正在開發 Frozen v2 AI 推論晶片。該晶片將 Gemini 的部分架構直接嵌入硬體,以在模型執行期間降低計算與資料移動的額外負擔。預期該晶片在每瓦效能方面的可處理 token 數量,將比 Google 最新一代 TPU 高出 6 到 10 倍;部署計畫最早可望在 2028 年進行。 此舉旨在解決 Google 日益惡化的晶片短缺問題,該問題已迫使 Google Cloud 取消外部客戶訂單。Frozen v2 將與 TPU 同步運作;雖然 TPU 支援多種模型,但 Frozen v2 更重視效率而非彈性。