
据媒体报道,谷歌正在开发代号为 "Frozen v2" 的新一代 AI 服务器芯片。该芯片旨在通过将部分模型直接嵌入硬件,更高效地运行其 Gemini 大语言模型。
若达成内部预定目标,Frozen v2 在同等功耗下处理 AI 令牌(tokens)的数量,预计将达到谷歌最新张量处理单元(TPU)的 6 至 10 倍。
专为推理打造,补充而非取代 TPU
与通用的 TPU 不同,Frozen v2 专为 AI 推理阶段设计,即模型生成响应的过程。谷歌计划将 Gemini 神经网络架构的部分内容固化至芯片中,以降低计算量并减少功耗。该芯片并非旨在取代 TPU,而是作为补充,专门应对大规模推理工作负载。
此举背景在于谷歌自身产品及 Google Cloud 对 AI 算力的需求激增。此前,算力短缺曾迫使谷歌优先保障内部负载,甚至拒绝部分外部云客户的服务请求。提升推理效率将使谷歌无需同比例扩大数据中心规模,即可处理更多 AI 请求。
预计 2028 年投产
报道指出,Frozen v2 最早可能于 2028 年投入生产。与支持广泛 AI 工作负载的现有 TPU 不同,该芯片将主要服务于谷歌的 Gemini 模型。
过去十年间,谷歌持续加大定制芯片研发力度,以减少对第三方 AI 硬件的依赖。其 TPU 系列产品不仅支撑了谷歌各项服务及 Google Cloud 的训练和推理需求,也向外部开发者和企业开放访问权限。
【星途科讯 图文丨伊贝 首发于 ZAKER 科技,转载请注明出处】


