Google在Flash系列中发布了三款新模型——Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber——针对速度、成本效率和高容量智能体工作进行了优化,而非追求最大推理深度。

  • Gemini 3.6 Flash的输出token比3.5 Flash减少17%(在DeepSWE上最高减少65%),并将输出价格从每1M token 9.00美元降至7.50美元,同时在DeepSWE(49% vs 37%)和MLE Bench(63.9% vs 49.7%)上的得分更高。
  • Gemini 3.5 Flash-Lite以每秒350个输出token的低延迟性能运行,价格为每1M token 0.30/2.50美元,在SWE-Bench Pro(54.2% vs 49.6%)和OSWorld-Verified(74.0% vs 65.1%)上优于旧版3 Flash。
  • Gemini 3.5 Flash Cyber是专为发现和修补软件漏洞而设计的专用模型,在CodeMender智能体中用于发现55个独特的V8问题,而主线3.5 Flash仅发现47个。

这些模型可通过Gemini API、Google AI Studio、Android Studio和GitHub Copilot获取,其中3.5 Flash Cyber目前因双重用途风险仅限政府和可信合作伙伴使用。