Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,Flash 系更便宜且 token 效率更高
决策简报
Brief- 发生了什么
- Google 发布三款新 Gemini 模型:3.6 Flash 降低输出 token 用量和价格,3.5 Flash-Lite 主打低延迟高吞吐,3.5 Flash Cyber 专用于漏洞挖掘。
- 为什么重要
- Google 相关变化会影响地区可用性、合规成本和供应商风险。
- 影响谁
- Claude · Gemini · Qwen
- 建议动作
- 升级或复核变更版本
- 地区可用性
- 暂未验证地区可用性差异。
关键事实
- Google 发布三款新 Gemini 模型:3.6 Flash 降低输出 token 用量和价格,3.5 Flash-Lite 主打低延迟高吞吐,3.5 Flash Cyber 专用于漏洞挖掘。 [src-marktechpost]
- 3.6 Flash 输出 token 减少 17%、价格降至 $7.50/百万,直接降低代理任务的 token 成本和每次调用的开销。 [src-marktechpost]
由事件证据自动生成。
Gemini 3.6 Flash 是新的默认工作模型,相比 3.5 Flash 输出 token 减少 17%(DeepSWE 上最高减少 65%),输出价格从 $9.00 降至 $7.50/百万 token。在 DeepSWE 上得分 49% 对 37%,MLE Bench 达 63.9% 对 49.7%,OSWorld-Verified 达 83.0% 对 78.4%。Computer use 作为内置客户端工具通过 Gemini API 和 Gemini Enterprise 提供。Gemini 3.5 Flash-Lite 面向低延迟高吞吐场景,速率 350 token/秒,定价 $0.30/百万输入、$2.50/百万输出,在 Terminal-Bench 2.1 得分 54%,并支持可配置的思考层级。Gemini 3.5 Flash Cyber 基于 3.5 Flash 微调,专用于发现、验证和修补软件漏洞,在 CodeMender 中并行调用最多五次后合并结果。在 Big Sleep 评估中于 V8 引擎发现 55 个独特确认问题,超过 3.5 Flash 的 47 个和 Claude Opus 4.6 的 36 个。Flash Cyber 因双重用途风险仅限政府及受信合作伙伴有限访问。 使用 Gemini API 的开发者可直接调用 3.6 Flash 和 3.5 Flash-Lite,后者通过更低的 token 成本和高速率适合高并发场景。构建代码安全代理的团队可利用 Flash Cyber 在 CodeMender 中快速发现漏洞。Enterprise 用户可在 Gemini Enterprise Agent Platform 中使用这些模型。
来源
- MarkTechPost
Fast research-paper and ML tooling summaries, useful for infra and agent updates.
- MarkTechPost
留言
登入后即可留言,和其他 builder 交换实测心得。
还没有留言,抢头香。