Google的Gemini 3.6 Flash瞄准企业代理令牌成本 - AI News
Google的Gemini 3.6 Flash瞄准企业代理令牌成本

Google的Gemini 3.6 Flash瞄准企业代理令牌成本

2026-07-21

新闻要点

Google本周发布Gemini 3.6 Flash、3.5 Flash-Lite及Cyber三款新模型,旨在降低企业AI代理的延迟和token成本。其中3.6 Flash输出token较3.5 Flash减少17%,定价$1.5/1M输入、$7.5/1M输出,已被Figma、Harvey等企业应用;Lite版针对高吞吐场景,Cyber版用于漏洞修复。

- Gemini 3.6 Flash输出token较3.5 Flash少17%,性能提升

- 3.6 Flash定价$1.5/1M输入、$7.5/1M输出,已被Figma等采用

- 3.5 Flash-Lite高吞吐低延迟,定价$0.3/$2.5每百万token

- 3.5 Flash Cyber专为漏洞修复场景设计

主要内容

Google今日发布Gemini 3.6 Flash、3.5 Flash-Lite及3.5 Flash Cyber三个新模型,专为企业AI代理降低延迟和token成本设计。三个模型分别定位编码推理、高容量任务与漏洞修复场景,平衡性能与成本需求。

其中,Gemini 3.6 Flash输出token较前代3.5 Flash减少17%,测试中最多降低65%。定价为每百万输入token1.50美元、输出token7.50美元,适合持续运行的推理循环。在DeepSWE测试中成功率49%(前代37%),MLE Bench从49.7%升至63.9%,GDPval-AA v2得分1421(前代1349)。

Figma、Harvey和Hebbia已应用该模型:Figma将其集成到原型设计工具,提升开发迭代效率;法律平台Harvey和研究工具Hebbia通过模型处理多模态文档,解析财务文件并生成报告。

Gemini 3.5 Flash-Lite每秒输出350token,定价更低(输入$0.3/1M,输出$2.5/1M),适合高容量任务。在GDM-MRCR v2测试中成功率72.2%(前代60.1%),GDPval-AA v2得分从642增至1140。

3.5 Flash Cyber为受限模型,专注代码漏洞验证与修复,填补安全扫描与修复的效率差距。