星途科讯 4小时前
谷歌自研Gemini专用芯片Frozen v2
index.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

据媒体报道,谷歌正在开发代号为 "Frozen v2" 的新一代 AI 服务器芯片。该芯片旨在通过将部分模型直接嵌入硬件,更高效地运行其 Gemini 大语言模型。

若达成内部预定目标,Frozen v2 在同等功耗下处理 AI 令牌(tokens)的数量,预计将达到谷歌最新张量处理单元(TPU)的 6 至 10 倍。

专为推理打造,补充而非取代 TPU

与通用的 TPU 不同,Frozen v2 专为 AI 推理阶段设计,即模型生成响应的过程。谷歌计划将 Gemini 神经网络架构的部分内容固化至芯片中,以降低计算量并减少功耗。该芯片并非旨在取代 TPU,而是作为补充,专门应对大规模推理工作负载。

此举背景在于谷歌自身产品及 Google Cloud 对 AI 算力的需求激增。此前,算力短缺曾迫使谷歌优先保障内部负载,甚至拒绝部分外部云客户的服务请求。提升推理效率将使谷歌无需同比例扩大数据中心规模,即可处理更多 AI 请求。

预计 2028 年投产

报道指出,Frozen v2 最早可能于 2028 年投入生产。与支持广泛 AI 工作负载的现有 TPU 不同,该芯片将主要服务于谷歌的 Gemini 模型。

过去十年间,谷歌持续加大定制芯片研发力度,以减少对第三方 AI 硬件的依赖。其 TPU 系列产品不仅支撑了谷歌各项服务及 Google Cloud 的训练和推理需求,也向外部开发者和企业开放访问权限。

【星途科讯 图文丨伊贝 首发于 ZAKER 科技,转载请注明出处】

评论
大家都在看