主要内容
Google今日发布Gemini 3.6 Flash、3.5 Flash-Lite及3.5 Flash Cyber三个新模型,专为企业AI代理降低延迟和token成本设计。三个模型分别定位编码推理、高容量任务与漏洞修复场景,平衡性能与成本需求。
其中,Gemini 3.6 Flash输出token较前代3.5 Flash减少17%,测试中最多降低65%。定价为每百万输入token1.50美元、输出token7.50美元,适合持续运行的推理循环。在DeepSWE测试中成功率49%(前代37%),MLE Bench从49.7%升至63.9%,GDPval-AA v2得分1421(前代1349)。
Figma、Harvey和Hebbia已应用该模型:Figma将其集成到原型设计工具,提升开发迭代效率;法律平台Harvey和研究工具Hebbia通过模型处理多模态文档,解析财务文件并生成报告。
Gemini 3.5 Flash-Lite每秒输出350token,定价更低(输入$0.3/1M,输出$2.5/1M),适合高容量任务。在GDM-MRCR v2测试中成功率72.2%(前代60.1%),GDPval-AA v2得分从642增至1140。
3.5 Flash Cyber为受限模型,专注代码漏洞验证与修复,填补安全扫描与修复的效率差距。