谷歌正在开发新款芯片:Gemini架构直接写入硅片,效率最高提升10倍
据科技媒体The Information报道,谷歌正在开发一款专为其Gemini AI模型量身定制的新型服务器芯片"Frozen v2",将模型架构直接固化于硅片之中,效率预计达现有自研芯片的6至10倍,最早有望于2028年投入部署。
算力短缺倒逼芯片革命
Frozen v2项目的直接驱动力,是谷歌内部严峻的AI算力短缺问题。这一短缺已引发内部矛盾,并迫使谷歌云拒绝部分外部客户的合作请求。Frozen v2将部分Gemini模型的决策逻辑预先嵌入芯片,从而减少运行时的计算步骤与数据搬运量,以提升响应速度并降低单位算力功耗。以每单位功耗可处理的token数量衡量,该芯片的效率预计达到谷歌现有最新一代自研AI芯片的6至10倍。
从"全固化"到"弹性固化"的技术演进
Frozen项目并非全新构想。其前身为最初由谷歌DeepMind首席科学家Jeff Dean主导的"原版Frozen"方案,该方案计划将模型权重本身直接烧录进芯片。然而,由于这一设计将使芯片仅能服务于某一特定版本的Gemini模型,生命周期过短,该方案已被搁置。Frozen v2转向"弹性固化"思路——固化模型架构而非具体权重,从而在保留效率优势的同时延长芯片使用周期。芯片可支持模型权重的更新,即决定模型如何响应问题的参数设置。
定位TPU之外的新分支
谷歌明确将Frozen v2定位为TPU产品线之外的新分支,而非对现有自研芯片体系的替代。TPU与英伟达GPU同属通用AI芯片,可兼容多种模型;Frozen v2则专为Gemini打造,两条产品线将并行发展。在行业参照系上,加拿大芯片初创公司Taalas采用了类似的将特定AI模型硬编码入芯片的设计理念,已融资逾2亿美元。英伟达则于去年12月斥资200亿美元与推理芯片初创公司Groq达成技术授权协议。受上述消息提振,谷歌股价周一盘中一度上涨3.7%,最终收涨1.52%。