回到时间线

7月22日周三01:45Model/API模型发布API 与价格Agent模型发布指南

Google 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber,Flash 系更便宜且 token 效率更高

决策简报

Brief
发生了什么
Google 发布三款新 Gemini 模型:3.6 Flash 降低输出 token 用量和价格,3.5 Flash-Lite 主打低延迟高吞吐,3.5 Flash Cyber 专用于漏洞挖掘。
为什么重要
Google 相关变化会影响地区可用性、合规成本和供应商风险。
影响谁
Claude · Gemini · Qwen
建议动作
升级或复核变更版本
地区可用性
暂未验证地区可用性差异。

关键事实

  • Google 发布三款新 Gemini 模型:3.6 Flash 降低输出 token 用量和价格,3.5 Flash-Lite 主打低延迟高吞吐,3.5 Flash Cyber 专用于漏洞挖掘。 [src-marktechpost]
  • 3.6 Flash 输出 token 减少 17%、价格降至 $7.50/百万,直接降低代理任务的 token 成本和每次调用的开销。 [src-marktechpost]
高信心100% 主张有证据

由事件证据自动生成。

Gemini 3.6 Flash 是新的默认工作模型,相比 3.5 Flash 输出 token 减少 17%(DeepSWE 上最高减少 65%),输出价格从 $9.00 降至 $7.50/百万 token。在 DeepSWE 上得分 49% 对 37%,MLE Bench 达 63.9% 对 49.7%,OSWorld-Verified 达 83.0% 对 78.4%。Computer use 作为内置客户端工具通过 Gemini API 和 Gemini Enterprise 提供。Gemini 3.5 Flash-Lite 面向低延迟高吞吐场景,速率 350 token/秒,定价 $0.30/百万输入、$2.50/百万输出,在 Terminal-Bench 2.1 得分 54%,并支持可配置的思考层级。Gemini 3.5 Flash Cyber 基于 3.5 Flash 微调,专用于发现、验证和修补软件漏洞,在 CodeMender 中并行调用最多五次后合并结果。在 Big Sleep 评估中于 V8 引擎发现 55 个独特确认问题,超过 3.5 Flash 的 47 个和 Claude Opus 4.6 的 36 个。Flash Cyber 因双重用途风险仅限政府及受信合作伙伴有限访问。 使用 Gemini API 的开发者可直接调用 3.6 Flash 和 3.5 Flash-Lite,后者通过更低的 token 成本和高速率适合高并发场景。构建代码安全代理的团队可利用 Flash Cyber 在 CodeMender 中快速发现漏洞。Enterprise 用户可在 Gemini Enterprise Agent Platform 中使用这些模型。

摘要依据:已读全文详摘依据上方标注的来源范围整理,内容以原文为准。

来源

  • MarkTechPost

    Fast research-paper and ML tooling summaries, useful for infra and agent updates.

  • MarkTechPost

相关情报

留言

登入后即可留言,和其他 builder 交换实测心得。

还没有留言,抢头香。