구글, 차세대 모델 Gemini 3.6 Flash 및 3.5 Flash Lite 공개
성능 개선 및 토큰 비용 절감 모델로, API 비용 최적화 및 추론 성능 검토가 필요합니다.
요약
구글이 코딩 및 에이전트 워크플로우에 특화된 고효율 모델 Gemini 3.6 Flash를 공개했으며, 이는 Gemini 3.5 Flash 대비 출력 토큰 소비를 17% 줄이고 가격을 100만 토큰당 입력 1.50달러, 출력 7.50달러로 책정했습니다. Gemini 3.6 Flash는 OSWorld Verified 83.0% 및 DeepSWE 49%의 성능을 기록하며 컴퓨터 제어 및 코딩 정밀도가 향상되었습니다. 함께 출시된 Gemini 3.5 Flash Lite는 초당 350토큰의 속도와 100만 토큰당 입력 0.30달러, 출력 2.50달러의 저비용을 강점으로 하며 대규모 에이전트 작업에 최적화되었습니다. 특히 Gemini 3.5 Flash Lite는 SWE Bench Pro 54.2%를 기록하며 기존 Flash 모델을 능가하는 성능을 보입니다. 또한, 소프트웨어 보안 취약점 탐지 및 패치를 위해 설계된 전문 모델 Gemini 3.5 Flash Cyber는 CodeMender 인프라를 통해 정부 및 파트너를 대상으로 제한적으로 운영됩니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @ai_for_success: Google just released 3 new Gemini models. - Gemini 3.6 Flash - Role: High efficiency workhorse model designed for coding, knowledg
원문 보기 ↗