본문으로 건너뛰기

← 뉴스레터 전체

AI NEWSLETTER

2026년 4월 2일 (목)

이 날 발표된 공식 원문을 2026.10.01에 확인해 소급 정리한 호입니다.

01PRODUCT UPDATE (제품 업데이트)

Gemini API 'Flex'·'Priority' 요금 단계와 선불 결제 도입

구글이 Gemini API에 두 가지 처리 단계를 추가했습니다. 급하지 않은 작업을 표준 가격의 절반에 처리하는 'Flex'와, 사용량이 몰릴 때도 먼저 처리해 주는 대신 더 비싼 'Priority'입니다. 4월 15일에는 미리 크레딧을 사서 그 안에서만 쓰는 선불 결제도 AI Studio에 도입했습니다. 3월 지출 상한에 이어 비용 통제 수단이 하나 더 늘었습니다.

핵심 사실 · 한눈에 보기

  • 4월 2일 구글이 Gemini API에 Flex와 Priority 처리 단계를 도입했습니다.
  • Flex는 표준 API 가격의 50%이며, 대신 처리 우선순위가 낮아 지연이 늘고 신뢰도가 떨어질 수 있습니다. 모든 유료 등급에서 쓸 수 있습니다.
  • Priority는 사용량이 몰릴 때도 요청이 밀려나지 않게 하는 프리미엄 단계로, 한도를 넘는 요청은 실패하지 않고 표준 단계로 처리됩니다. 유료 Tier 2·3 프로젝트가 대상입니다.
  • 두 단계 모두 일반 동기식 API에서 service_tier 값만 바꿔 쓰며, 응답 헤더로 어느 단계에서 처리됐는지 알려 줍니다.
  • 4월 15일 AI Studio에 선불 결제가 도입됐습니다. 처음에는 Gemini API를 켠 미국의 신규 Google Cloud 결제 계정이 대상이고, 몇 주 안에 전 세계로 넓힌다고 했습니다.

Flex와 Priority

구글은 에이전트 시대의 작업을 두 종류로 나눴습니다. 데이터 보강이나 백그라운드 '생각' 과정처럼 즉시 답이 필요 없는 작업과, 고객 상담 챗봇처럼 사용자가 기다리는 작업입니다. 지금까지는 앞의 것을 싸게 하려면 비동기 Batch API를 따로 써야 했는데, Flex는 같은 동기식 엔드포인트에서 가격만 절반으로 낮춥니다. 입력·출력 파일을 관리하거나 작업 완료를 계속 확인할 필요가 없습니다.

  • Flex: 표준의 50% 가격, 지연·신뢰도 하락 감수. 예: CRM 백그라운드 갱신, 대규모 연구 시뮬레이션, 백그라운드에서 '탐색'하는 에이전트
  • Priority: 프리미엄 가격, 피크 때도 우선 처리. 한도 초과분은 표준으로 자동 처리. 예: 실시간 고객 상담, 실시간 콘텐츠 검수
  • 확인: 응답 헤더(x-gemini-service-tier)로 실제 처리 단계 표시
전체 내용 보기이전과 달라진 점 · 나에게 미치는 영향 · 아직 모르는 것

SOURCE공식 원문 + 추가 출처

수집 2026.10.01 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

02MODEL RELEASE (모델 출시)

구글 공개 모델 'Gemma 4' 출시… 추론·에이전트용으로 설계

구글이 공개 모델 Gemma 4를 Apache 2.0 라이선스로 내놨습니다. 휴대폰용 E2B·E4B부터 노트북·워크스테이션용 26B MoE·31B까지 네 가지 크기로, 구글은 '파라미터당 지능'이 가장 높은 공개 모델이라고 소개했습니다. 이전 Gemma와 달리 상업적 이용이 자유로운 표준 오픈소스 라이선스를 택한 점이 큰 변화입니다.

핵심 사실 · 한눈에 보기

  • 4월 2일 구글이 Gemma 4를 E2B, E4B, 26B MoE, 31B Dense 네 가지 크기로 공개했습니다.
  • 상업적 이용이 허용되는 Apache 2.0 라이선스로 배포됩니다.
  • 작은 모델(E2B·E4B)은 맥락 12만8천 토큰, 큰 모델은 최대 25만6천 토큰이며, 140개 넘는 언어로 학습됐습니다.
  • 모든 모델이 이미지·영상을 이해하고, E2B·E4B는 음성 입력도 받습니다.
  • 구글은 31B가 Arena AI 텍스트 순위에서 공개 모델 3위, 26B가 6위였다고 밝혔습니다(4월 1일 기준).

크기별로 무엇에 쓰나

구글은 Gemma 4가 Gemini 3와 같은 연구·기술로 만들어졌고, 단순 대화를 넘어 여러 단계 계획, 함수 호출, 구조화된 JSON 출력 같은 에이전트 기능을 기본 지원한다고 밝혔습니다.

  • E2B·E4B: 휴대폰·라즈베리파이·Jetson Orin Nano 같은 기기에서 오프라인 실행. 추론 시 실질 20억·40억 파라미터만 써서 메모리와 배터리 절약. 퀄컴·미디어텍과 협력
  • 26B MoE: 추론 때 전체 중 38억 파라미터만 작동해 빠른 응답
  • 31B Dense: 품질 최우선, 미세조정의 바탕
  • 26B·31B: 양자화하지 않은 bfloat16 가중치가 H100 80GB GPU 한 장에 들어가고, 양자화 버전은 일반 소비자용 GPU에서 실행
전체 내용 보기이전과 달라진 점 · 나에게 미치는 영향 · 아직 모르는 것

SOURCE공식 원문 + 추가 출처

수집 2026.10.01 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

03PRODUCT UPDATE (제품 업데이트)

Codex, ChatGPT Business·Enterprise에 종량제 요금 도입

팀이 작게 시작해 사용량만큼 내는 방식이 생겼습니다.

핵심 사실

  • Codex가 ChatGPT Business와 Enterprise에 종량제(pay-as-you-go) 요금을 도입해, 팀이 도입을 시작하고 늘리기 쉬운 선택지를 제공한다고 OpenAI가 밝혔습니다.

왜 중요한가 · AI마중 해석

좌석당 정액제 대신 쓴 만큼 내는 방식은 시험 도입 부담을 줄입니다. 같은 달 GitHub Copilot도 사용량 기반 과금 전환을 발표했습니다.

그래서 나한테는?

회사에서 Codex를 일부 팀만 시험해 보려면 종량제가 유리할 수 있습니다. 월 상한을 함께 정하세요.

SOURCE공식 원문 확인

수집 2026.09.30 · 정리 2026.10.01 · 원문 본문은 옮기지 않았습니다.

04BUSINESS (비즈니스)

OpenAI, 기술 토크쇼 TBPN 인수

AI에 관한 대화를 넓히고 독립 미디어를 지원하겠다고 밝혔습니다.

핵심 사실

  • OpenAI는 AI에 관한 대화를 넓히고 독립 미디어를 지원하기 위해 TBPN을 인수한다고 밝혔습니다.

왜 중요한가 · AI마중 해석

AI 회사가 기술 미디어를 직접 소유하게 됐습니다. 인수 후 보도의 독립성을 어떻게 지키는지가 관건입니다.

그래서 나한테는?

직접적인 변화는 없지만, TBPN 콘텐츠를 볼 때 OpenAI 소유라는 점을 감안하세요.

SOURCE공식 원문 확인

수집 2026.09.30 · 정리 2026.10.01 · 원문 본문은 옮기지 않았습니다.