回到时间线

7月21日周二02:08模型发布API 与价格Infra / 成本模型发布指南

Google 自研 Frozen v2 芯片将 Gemini 架构固化到硅片中

决策简报

Brief
发生了什么
Google 内部正在开发 Frozen v2 服务器芯片,将 Gemini 模型架构直接嵌入硬件,预计 2028 年部署,效能可达当前 TPU 的 6 到 10 倍。
为什么重要
OpenAI 相关变化会影响 AI 产品团队的技术选型和发布判断。
影响谁
GPT · Gemini
建议动作
升级或复核变更版本
地区可用性
暂未验证地区可用性差异。

关键事实

  • Google 内部正在开发 Frozen v2 服务器芯片,将 Gemini 模型架构直接嵌入硬件,预计 2028 年部署,效能可达当前 TPU 的 6 到 10 倍。 [src-decoder]
  • Frozen v2 通过固化模型架构而非权重实现效率飞跃,将大幅降低 Google 内部推理成本,可能使其在价格上领先 OpenAI 和 Anthropic。 [src-decoder]
高信心100% 主张有证据

由事件证据自动生成。

据 The Information 报道,Google 正在推进一款名为 Frozen v2 的专用服务器芯片,该芯片将 Gemini 的模型架构直接固化到硬件中,而非像 TPU 那样通用支持多种模型。与最初的 Frozen 方案(将模型权重固定)不同,v2 版本只固化架构(即模型蓝图),权重仍可更新,因此更具灵活性。消息称,该芯片在 AI 推理任务上的效能可能是当前 TPU 的 6 到 10 倍,计划 2028 年部署,但产量较小,属于对专用芯片的试验。 Frozen v2 不会对外销售,主要用于缓解 Google 内部 AI 算力紧张。如果性能达标,它将成为 Google 的关键竞争优势:通过更低的推理成本提供更便宜的大模型服务,从而抢夺 OpenAI 和 Anthropic 的市场份额。对于使用 Gemini API 的开发者来说,这意味着未来可能获得更低价格或更高性能的推理服务,但短期内不会改变现有 API 调用方式。

摘要依据:已读全文详摘依据上方标注的来源范围整理,内容以原文为准。

来源

相关情报

留言

登入后即可留言,和其他 builder 交换实测心得。

还没有留言,抢头香。