무슨 일이 있었나?
Google이 코딩·지식 업무·멀티모달 성능과 토큰 효율을 높인 Gemini 3.6 Flash, 고처리량 작업을 겨냥한 3.5 Flash-Lite를 공개했습니다.
이번 업데이트는 최고 성능 하나보다 작업별 모델 라우팅이 중요해졌음을 보여줍니다. 복잡한 계획은 3.6 Flash, 반복적인 추출과 분류는 Flash-Lite처럼 나눌 수 있지만, 실제 비용은 프롬프트 길이와 재시도율을 포함한 자체 평가로 확인해야 합니다.
왜 중요한가?
에이전트 운영비는 모델 한 번의 가격뿐 아니라 출력 토큰, 도구 호출 횟수와 처리 속도에 좌우되므로 두 모델은 대규모 자동화의 비용 구조에 직접 영향을 줍니다.
누구에게 중요한가?
AI 개발자에이전트 운영팀기업
관련 AI
AIZIGOO 한줄평
속도와 벤치마크 수치는 Google 및 해당 평가기관이 공개한 결과이며 실제 워크로드에서는 달라질 수 있습니다.