- 类型
- 新闻
- 来源
- The Decoder AI News
- 发布
- 2026年7月20日 18:08
- 状态
- 单一信源
01
发生了什么
Google正在开发名为“Frozen v2”的服务器芯片,该芯片将Gemini模型架构直接固化在硬件中。据内部消息,其效率可能比当前TPU高6至10倍,计划于2028年推出。此举有望大幅降低谷歌的AI推理成本,并使谷歌在AI服务价格上优于OpenAI和Anthropic。
02
为什么重要
此前谷歌的TPU是通用AI加速器,而Frozen v2专门为Gemini架构设计,效率预期提升6-10倍,意味着谷歌可能获得显著的推理成本优势,打破现有AI服务定价格局。
03
底层逻辑
将模型架构直接集成到芯片中,消除了软件层与硬件之间的冗余开销,从而极大提升每瓦性能,降低推理延迟和单位成本。
04
产品与商业机会
该芯片预计2028年推出,届时谷歌的AI推理成本可能大幅下降,使其Gemini API定价更具竞争力,同时也降低内部AI产品运营成本,可能促使竞争对手调整价格策略。
- 基于成本优势,可推出更具竞争力的Gemini API定价方案以吸引个人和企业开发者。
- 面向大型企业客户推出基于Frozen v2的专用低成本AI推理服务,形成差异化优势。
05
仍待确认
- Frozen v2芯片当前是否已流片或仅停留在设计阶段?
- 其实际效率提升能否在量产中达到6-10倍?
- 2028年是否可能因技术挑战延期?
- 谷歌是否会将该芯片用于自用还是开放商用?