首页
学习
活动
专区
圈层
工具
发布

谷歌自研Gemini专用芯片Frozen v2

据媒体报道,谷歌正在开发代号为“Frozen v2”的新一代AI服务器芯片。该芯片旨在通过将部分模型直接嵌入硬件,更高效地运行其Gemini大语言模型。

若达成内部预定目标,Frozen v2在同等功耗下处理AI令牌(tokens)的数量,预计将达到谷歌最新张量处理单元(TPU)的6至10倍。

专为推理打造,补充而非取代TPU

与通用的TPU不同,Frozen v2专为AI推理阶段设计,即模型生成响应的过程。谷歌计划将Gemini神经网络架构的部分内容固化至芯片中,以降低计算量并减少功耗。该芯片并非旨在取代TPU,而是作为补充,专门应对大规模推理工作负载。

此举背景在于谷歌自身产品及Google Cloud对AI算力的需求激增。此前,算力短缺曾迫使谷歌优先保障内部负载,甚至拒绝部分外部云客户的服务请求。提升推理效率将使谷歌无需同比例扩大数据中心规模,即可处理更多AI请求。

预计2028年投产

报道指出,Frozen v2最早可能于2028年投入生产。与支持广泛AI工作负载的现有TPU不同,该芯片将主要服务于谷歌的Gemini模型。

过去十年间,谷歌持续加大定制芯片研发力度,以减少对第三方AI硬件的依赖。其TPU系列产品不仅支撑了谷歌各项服务及Google Cloud的训练和推理需求,也向外部开发者和企业开放访问权限。

【星途科讯 图文丨伊贝 首发于ZAKER科技,转载请注明出处】

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OtsriiQiRr9BM1LF4u5gl62Q0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券