2026년 3월 3일 (화)
이 날 발표된 공식 원문을 2026.10.01에 확인해 소급 정리한 호입니다.
일상 대화를 더 매끄럽고 쓸모 있게 만드는 데 초점을 맞춘 업데이트입니다.
- OpenAI가 2026년 3월 3일 'GPT-5.3 Instant: Smoother, more useful everyday conversations'를 발표하고 시스템 카드를 함께 공개했습니다.
Instant 등급은 ChatGPT에서 가장 많은 사람이 매일 쓰는 모델입니다. 화려한 최상위 모델보다 체감 변화가 큽니다.
평소 쓰던 ChatGPT의 말투나 답변 길이가 달라졌다고 느낄 수 있습니다.
수집 2026.09.30 · 정리 2026.10.01 · 원문 본문은 옮기지 않았습니다.
구글이 Gemini 3 계열에서 가장 빠르고 비용 효율적인 모델이라는 Gemini 3.1 Flash-Lite를 프리뷰로 내놨습니다. 가격은 100만 토큰당 입력 0.25달러·출력 1.50달러입니다.
- 구글은 Gemini 3.1 Flash-Lite를 Gemini 3 계열에서 가장 빠르고 비용 효율적인 모델이라고 발표했으며, 대량 처리용 개발자 작업이 주 대상입니다.
- 발표일부터 프리뷰로 제공되며, 개발자는 Gemini API·Google AI Studio, 기업은 Vertex AI에서 쓸 수 있습니다.
- 가격은 100만 토큰당 입력 0.25달러, 출력 1.50달러입니다.
- 구글이 인용한 Artificial Analysis 벤치마크 기준으로 2.5 Flash보다 첫 응답 토큰까지의 시간이 2.5배 빠르고 출력 속도는 45% 높으며, 품질은 비슷하거나 더 낫다고 구글이 설명했습니다.
Gemini 3 계열에 대량·저비용·저지연 작업을 위한 Flash-Lite 선택지가 더해졌습니다. '가장 빠르다'는 표현만 보기보다, 0.25달러·1.50달러라는 가격과 프리뷰 상태, 그리고 속도 비교가 구글이 인용한 외부 벤치마크라는 출처를 함께 봐야 합니다.
대량으로 API를 호출하는 서비스에서는 모델 최고 성능보다 토큰 가격과 지연 시간이 실제 비용을 좌우합니다. 분류·요약처럼 반복 작업이 많은 개발자는 2.5 Flash 대신 시험해 볼 만하지만, 프리뷰라 정식 출시 전 조건이 바뀔 수 있습니다.
수집 2026.10.01 · 정리 2026.10.01 · 수정 2026.10.06 · 원문 본문은 옮기지 않았습니다.