구글, Gemini 3.6 Flash 및 3.5 Flash-Lite 공개
- •구글이 작업 완료 시간을 50% 단축한 Gemini 3.6 Flash와 3.5 Flash-Lite를 발표했다.
- •Gemini 3.6 Flash는 기존 50점의 지능 점수를 유지했고, 3.5 Flash-Lite는 11점 상승했다.
- •가격 구조 변경으로 3.6 Flash는 18% 저렴해졌으나, 3.5 Flash-Lite는 비용이 2배 증가했다.
구글 딥마인드(Google DeepMind)는 2026년 7월 21일 Gemini 3.6 Flash와 Gemini 3.5 Flash-Lite를 공개했다. 두 모델 모두 토큰 효율성을 개선해 이전 모델 대비 작업 완료 시간을 약 50% 단축했다. Gemini 3.6 Flash는 이전 버전과 동일하게 인공지능 분석 지수(Artificial Analysis Intelligence Index) 50점을 기록했고, Gemini 3.5 Flash-Lite는 11점 상승한 36점을 달성했다.
Gemini 3.6 Flash의 작업당 평균 처리 시간은 1.3분으로, 기존 2.7분 대비 50% 빨라졌다. 작업당 비용은 약 18% 감소하여 0.59달러에서 0.50달러로 조정됐다. 새로운 가격 정책은 입력 토큰 100만 개당 1.50달러, 출력 토큰 100만 개당 7.50달러다. 또한 100만 개의 컨텍스트 윈도우를 유지하며 텍스트, 이미지, 영상, 음성을 포함한 멀티모달 입력을 지원한다.
Gemini 3.5 Flash-Lite는 작업당 평균 0.6분의 처리 시간을 기록해 이전 3.1 버전의 1.0분보다 개선됐다. 다만 처리 속도 향상에도 불구하고 작업당 평균 비용은 0.04달러에서 0.09달러로 올랐는데, 이는 입력 토큰 100만 개당 0.30달러, 출력 토큰 100만 개당 2.50달러로 가격이 책정된 결과다. 성능 향상은 에이전트 평가 지표의 개선 덕분이며, 특히 TerminalBench v2.1 벤치마크에서 22.5점 상승했다. 두 모델 모두 캐시된 입력 토큰에 대해 90% 할인 혜택을 제공한다.