본문으로 건너뛰기

← 2026.03.03 뉴스레터

2026.03.03 발표 · Google (The Keyword · AI)

MODEL RELEASE (모델 출시)

구글 'Gemini 3.1 Flash-Lite'… Gemini 3 중 가장 빠르고 저렴

구글이 Gemini 3 계열에서 가장 빠르고 비용 효율적인 모델이라는 Gemini 3.1 Flash-Lite를 프리뷰로 내놨습니다. 가격은 100만 토큰당 입력 0.25달러·출력 1.50달러입니다.

핵심 사실

  • 구글은 Gemini 3.1 Flash-Lite를 Gemini 3 계열에서 가장 빠르고 비용 효율적인 모델이라고 발표했으며, 대량 처리용 개발자 작업이 주 대상입니다.
  • 발표일부터 프리뷰로 제공되며, 개발자는 Gemini API·Google AI Studio, 기업은 Vertex AI에서 쓸 수 있습니다.
  • 가격은 100만 토큰당 입력 0.25달러, 출력 1.50달러입니다.
  • 구글이 인용한 Artificial Analysis 벤치마크 기준으로 2.5 Flash보다 첫 응답 토큰까지의 시간이 2.5배 빠르고 출력 속도는 45% 높으며, 품질은 비슷하거나 더 낫다고 구글이 설명했습니다.

왜 중요한가 · AI마중 해석

Gemini 3 계열에 대량·저비용·저지연 작업을 위한 Flash-Lite 선택지가 더해졌습니다. '가장 빠르다'는 표현만 보기보다, 0.25달러·1.50달러라는 가격과 프리뷰 상태, 그리고 속도 비교가 구글이 인용한 외부 벤치마크라는 출처를 함께 봐야 합니다.

그래서 나한테는?

대량으로 API를 호출하는 서비스에서는 모델 최고 성능보다 토큰 가격과 지연 시간이 실제 비용을 좌우합니다. 분류·요약처럼 반복 작업이 많은 개발자는 2.5 Flash 대신 시험해 볼 만하지만, 프리뷰라 정식 출시 전 조건이 바뀔 수 있습니다.

SOURCE공식 원문 + 추가 출처

수집 2026.10.01 · 정리 2026.10.01 · 수정 2026.10.06 · 원문 본문은 옮기지 않았습니다.

같은 주제 · Google

Google 전체 →