참고The Verge
Gemini 3.8 Flash, 추론 강화로 사용량 증가 가능성
반복적 도구 호출로 성능은 향상됐으나 토큰 소모량이 늘어날 수 있음. API 비용 최적화 시 고려 필요.
요약
구글이 전작 출시 후 몇 주 만에 신규 모델인 Gemini 3.8 Flash를 공개했다. 이 모델은 이전 버전인 Gemini 3.7 Flash보다 복잡한 작업에서 더 많은 추론 단계를 수행하고 도구를 반복적으로 호출하는 등 '더 열심히' 작동하도록 설계되었다. 도입 가격은 입력 토큰 100만 개당 0.75달러, 출력 토큰 100만 개당 3.75달러로 3.7 Flash와 동일하다. 하지만 구글은 성능 극대화를 위해 모델이 더 많은 토큰을 사용할 수 있다고 경고하여 실제 사용 비용은 더 높아질 가능성이 있다. 토큰 사용량을 최소화하려는 개발자는 기존의 Gemini 3.7 Flash를 계속 사용할 수 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Google says its new Gemini 3.8 Flash model ‘works harder’ but might cost more
원문 보기 ↗