谷歌自研Frozen v2晶片整合Gemini架構 劍指輝達AI市場

商傳媒|葉安庭/綜合外電報導
谷歌(Google)正積極研發一款專為其人工智慧(AI)模型 Gemini 量身打造的內部伺服器晶片,代號「Frozen v2」,預計將其架構直接整合於晶片硬體中。據《The Information》報導,這款晶片預計可將 AI 回應效率提升 6 至 10 倍,遠超谷歌現有的張量處理單元(TPU)晶片,並規劃於 2028 年開始部署。
「Frozen v2」晶片的核心概念,源於谷歌 DeepMind 首席科學家傑夫·迪恩(Jeff Dean)最初提出的想法,旨在將 AI 模型架構而非模型權重永久嵌入晶片。此設計確保了晶片的適應性,未來仍可載入新的模型權重,克服了初代「Frozen」晶片因模型快速迭代而可能迅速過時的問題。與通用的 TPU 晶片不同,Frozen v2 的高度專業化使其預計不會對外部客戶開放銷售,主要目的在於緩解谷歌內部對 AI 運算能力的需求壓力。
谷歌此舉的背後,是日益增長的 AI 運算成本挑戰。Flexera 的報告指出,許多企業的 AI 預算增長速度超出預期,且隨著採用率提高,運算、資料儲存、模型使用費以及基礎設施成本也隨之攀升。AI 服務的複雜計費模式,如基於 Token(單詞或片段)的消耗、API 使用費及 GPU 資源成本,都讓成本預測與優化變得困難。GitHub Copilot 在轉用 Token 計費後,也引發用戶對費用飆升的擔憂,凸顯 AI 軟體開支管理的挑戰。
透過 Frozen v2 晶片,谷歌期望大幅降低 AI 推理(Inference)成本,從而在競爭激烈的 AI 市場中取得顯著優勢,特別是能與 OpenAI 和 Anthropic 等競爭對手抗衡。此戰略也與谷歌既定的目標相呼應,即希望其 TPU 晶片能夠佔據輝達(Nvidia)年度營收的百分之十。隨著科技巨頭紛紛投入自研 AI 晶片,這將加速全球 AI 晶片市場的競爭態勢,並對既有的半導體供應鏈帶來深遠影響。
相關新聞
探討當前輝達(Nvidia)AI 晶片的物理極限、封裝瓶頸與未來的材料及架構解方。
Salesforce 簽約 Anthropic 後自研 AI 新模型 Koa 攜手輝達出擊
Googlebook 筆電 9/21 開放預購 強調 Gemini AI 深度整合
輝達稱霸AI訓練市場 推理應用成下波成長關鍵
三星力挺荷蘭新創 2.31 億美元,助其挑戰輝達 AI 晶片霸主地位
高通新 NPU 整合 MoE 架構 手機 AI 運算突破 300 億參數
Google Gemini 深度整合 Windows 「Alt+Space」速喚 AI 助手,智慧處理日常作業
Google 開放工程師使用 Claude AI 模型整合趨勢挑戰內部自研
軟體巨頭搶攻自研AI晶片 抗輝達壟斷並深化供應鏈挑戰
Google AI 戰略多點開花:Gemini 進攻車用與金融市場 新模型卻延遲
Google Gemini 3.8 Live登場 強化AI語音即時互動與多步驟推理
影音/彰基採用輝達B200晶片為基礎 打造AI「超級電腦」提升智慧醫療算力
AI 發展新瓶頸:模型之外,上下文與控制架構成關鍵挑戰
輝達 GeForce RTX 5090 湧入 AI 伺服器 高階遊戲卡價翻倍