Google 自研 Frozen v2 芯片将 Gemini 架构固化到硅片中
决策简报
Brief- 发生了什么
- Google 内部正在开发 Frozen v2 服务器芯片,将 Gemini 模型架构直接嵌入硬件,预计 2028 年部署,效能可达当前 TPU 的 6 到 10 倍。
- 为什么重要
- OpenAI 相关变化会影响 AI 产品团队的技术选型和发布判断。
- 影响谁
- GPT · Gemini
- 建议动作
- 升级或复核变更版本
- 地区可用性
- 暂未验证地区可用性差异。
关键事实
- Google 内部正在开发 Frozen v2 服务器芯片,将 Gemini 模型架构直接嵌入硬件,预计 2028 年部署,效能可达当前 TPU 的 6 到 10 倍。 [src-decoder]
- Frozen v2 通过固化模型架构而非权重实现效率飞跃,将大幅降低 Google 内部推理成本,可能使其在价格上领先 OpenAI 和 Anthropic。 [src-decoder]
由事件证据自动生成。
据 The Information 报道,Google 正在推进一款名为 Frozen v2 的专用服务器芯片,该芯片将 Gemini 的模型架构直接固化到硬件中,而非像 TPU 那样通用支持多种模型。与最初的 Frozen 方案(将模型权重固定)不同,v2 版本只固化架构(即模型蓝图),权重仍可更新,因此更具灵活性。消息称,该芯片在 AI 推理任务上的效能可能是当前 TPU 的 6 到 10 倍,计划 2028 年部署,但产量较小,属于对专用芯片的试验。 Frozen v2 不会对外销售,主要用于缓解 Google 内部 AI 算力紧张。如果性能达标,它将成为 Google 的关键竞争优势:通过更低的推理成本提供更便宜的大模型服务,从而抢夺 OpenAI 和 Anthropic 的市场份额。对于使用 Gemini API 的开发者来说,这意味着未来可能获得更低价格或更高性能的推理服务,但短期内不会改变现有 API 调用方式。
摘要依据:已读全文详摘依据上方标注的来源范围整理,内容以原文为准。
来源
- The Decoder:AI News
- The Decoder:AI News
留言
登入后即可留言,和其他 builder 交换实测心得。
还没有留言,抢头香。