모델NEW MODEL

Google, Gemini 3.6 Flash·3.5 Flash-Lite 공개…에이전트 효율 경쟁

Google이 코딩·지식 업무·멀티모달 성능과 토큰 효율을 높인 Gemini 3.6 Flash, 고처리량 작업을 겨냥한 3.5 Flash-Lite를 공개했습니다.

2026. 07. 22.1 개 출처 검토
10초 요약
  • Google은 3.6 Flash가 3.5 Flash보다 Artificial Analysis 기준 출력 토큰을 17% 적게 사용한다고 밝혔습니다.
  • 3.6 Flash 가격은 입력 100만 토큰당 1.50달러, 출력 100만 토큰당 7.50달러입니다.
  • 3.5 Flash-Lite는 초당 350개 출력 토큰과 입력 0.30달러·출력 2.50달러의 가격을 내세웁니다.
WHAT HAPPENED

무슨 일이 있었나?

Google이 코딩·지식 업무·멀티모달 성능과 토큰 효율을 높인 Gemini 3.6 Flash, 고처리량 작업을 겨냥한 3.5 Flash-Lite를 공개했습니다.

이번 업데이트는 최고 성능 하나보다 작업별 모델 라우팅이 중요해졌음을 보여줍니다. 복잡한 계획은 3.6 Flash, 반복적인 추출과 분류는 Flash-Lite처럼 나눌 수 있지만, 실제 비용은 프롬프트 길이와 재시도율을 포함한 자체 평가로 확인해야 합니다.

WHY IT MATTERS

왜 중요한가?

에이전트 운영비는 모델 한 번의 가격뿐 아니라 출력 토큰, 도구 호출 횟수와 처리 속도에 좌우되므로 두 모델은 대규모 자동화의 비용 구조에 직접 영향을 줍니다.

WHO SHOULD CARE

누구에게 중요한가?

AI 개발자에이전트 운영팀기업
RELATED AI

관련 AI

AIZIGOO VIEW

AIZIGOO 한줄평

속도와 벤치마크 수치는 Google 및 해당 평가기관이 공개한 결과이며 실제 워크로드에서는 달라질 수 있습니다.