模型

Google同批发布Gemini 3.6 Flash与3.5 Flash-Lite

Gemini 3.6 Flash与3.5 Flash-Lite发布

模型推理推理加速

概述

Google同批正式发布两款Flash系模型,当天经Gemini API与Google AI Studio等渠道可用。Gemini 3.6 Flash更新了编码、知识工作、计算机使用与多模态能力,并减少完成代理任务所需的输出token,官方口径指向代理场景的成本与速度优化;Gemini 3.5 Flash-Lite定位高吞吐代理任务与文档处理的低延迟轻量版本。两类负载差异明显的团队可分别测试:代理编排类工作负载关注3.6 Flash的token消耗变化,批量文档处理关注Flash-Lite的延迟与吞吐表现;各项能力的实际提升幅度需在自有任务上评测。