Google은 최대 추론 깊이보다는 속도, 비용 효율성, 그리고 대용량 에이전트 작업에 최적화된 플래시 계층의 세 가지 새로운 모델인 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 출시했습니다.

  • Gemini 3.6 Flash는 3.5 Flash보다 출력 토큰을 17% 적게 사용하며(DeepSWE에서 최대 65% 감소), 1M 토큰당 출력을 $9.00에서 $7.50로 낮추고, DeepSWE(49% 대 37%)와 MLE Bench(63.9% 대 49.7%)에서 더 높은 점수를 기록했습니다.
  • Gemini 3.5 Flash-Lite는 1M 토큰당 $0.30/$2.50의 가격으로 초당 350개의 출력 토큰을 처리하는 저지연 성능을 제공하며, SWE-Bench Pro(54.2% 대 49.6%)와 OSWorld-Verified(74.0% 대 65.1%)에서 이전의 3 Flash를 능가했습니다.
  • Gemini 3.5 Flash Cyber는 소프트웨어 취약점 발견 및 패치를 위한 전용 모델로, CodeMender 에이전트에서 사용되어 메인라인 3.5 Flash의 47개와 비교해 55개의 고유한 V8 이슈를 찾아냈습니다.

이 모델들은 Gemini API, Google AI Studio, Android Studio, GitHub Copilot를 통해 이용 가능하며, 3.5 Flash Cyber는 이중 사용 위험으로 인해 현재 정부 및 신뢰할 수 있는 파트너에게만 제한적으로 제공됩니다.