- 类型
- 模型
- 来源
- AIHOT · X / 公众号精选
- 发布
- 2026年7月21日 15:54
- 状态
- 单一信源
01
发生了什么
Google 推出三款新模型:3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber。3.6 Flash 在复杂编码任务中 token 用量最高减少 65%,3.5 Flash-Lite 速度达 350 输出 token/秒。前两款已在 Gemini 应用上线,3.5 Pro 进入合作伙伴测试。
02
为什么重要
相比此前模型,3.6 Flash 在编码任务中 token 消耗显著降低,3.5 Flash-Lite 达到 350 token/秒的高输出速度,直接降低推理成本并提升用户体验。
03
底层逻辑
底层逻辑尚未生成当前仅展示原文证据与规则信号,不用规则补写影响结论。
04
产品与商业机会
开发者可使用 3.6 Flash 减少编码相关 API 调用成本,3.5 Flash-Lite 的高速度适合需要低延迟的实时应用场景,如对话或代码补全。
- 利用 3.6 Flash 优化内部代码审查或自动生成工具,降低 token 消耗。
- 基于 3.5 Flash-Lite 构建高吞吐量的实时客服或翻译应用。
05
仍待确认
- 3.5 Flash Cyber 的具体性能指标和适用场景是什么?
- 3.5 Pro 合作伙伴测试何时结束、定价如何?
- 是否存在模型版本兼容性或微调限制?