구글, 차세대 Gemini 3.6 및 3.5 Flash 모델 공개
- •구글이 에이전틱 워크플로우 지원을 위해 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 출시했다.
- •Gemini 3.6 Flash는 토큰 효율성을 17% 개선했으며 코딩과 멀티모달 작업에서 높은 벤치마크 점수를 기록했다.
- •Gemini 3.5 Flash-Lite는 초당 350 토큰의 속도로 고처리량 프로덕션 환경에 최적화됐다.
구글은 효율성과 지연시간, 안정성을 극대화해 에이전틱 워크플로우를 지원할 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber 모델 3종을 새롭게 발표했다. 이번에 공개된 Gemini 3.6 Flash는 코딩 및 멀티모달 작업 능력을 강화한 주력 모델로, 이전 세대 대비 출력 토큰 사용량을 17% 줄인 것이 특징이다. 가격은 입력 100만 토큰당 $1.50, 출력 100만 토큰당 $7.50으로 책정됐다. 주요 벤치마크 결과로는 DeepSWE에서 49%(기존 37%), MLE Bench에서 63.9%(기존 49.7%), OSWorld-Verified에서 83.0%(기존 78.4%)의 개선을 보였다.
Gemini 3.5 Flash-Lite는 에이전틱 검색 등 낮은 지연시간이 요구되는 고처리량 작업에 최적화됐다. 이 모델은 초당 350 토큰의 처리 속도를 달성했으며, 입력 100만 토큰당 $0.30, 출력 100만 토큰당 $2.50에 제공된다. 성능은 SWE-Bench Pro 54.2%, OSWorld-Verified 74.0%를 기록했다. 현재 구글 검색에 적용 중이며, Gemini API, 구글 AI Studio, Android Studio를 통해 이용 가능하다. 또한, 컴퓨터 활용 기능이 클라이언트 측 도구로 내장됐다.
사이버 보안 특화 모델인 Gemini 3.5 Flash Cyber는 취약점 탐지 및 패치 작업에 특화 설계됐다. 해당 모델은 여러 에이전트를 활용해 보안 보고서를 생성하는 에이전틱 인프라 CodeMender 환경에 맞춰 미세 조정됐다. 오용 가능성을 고려해 구글은 정부 기관 및 신뢰할 수 있는 파트너 대상의 파일럿 프로그램을 통해서만 접근을 제한적으로 허용한다. 한편, 구글은 Gemini 3.5 Pro가 현재 테스트 중이며 차기 Gemini 4 모델의 사전 학습도 시작됐다고 밝혔다.