본문으로 건너뛰기

← 2026.02.05 뉴스레터

2026.02.05 발표 · Anthropic

MODEL RELEASE (모델 출시)

Anthropic, 최상위 모델 'Claude Opus 4.6' 출시

Anthropic이 최상위 모델 Claude Opus 4.6을 내놨습니다. Opus 계열로는 처음 100만 토큰 맥락(베타)을 지원하고, 가격은 이전과 같은 입력 5달러·출력 25달러(100만 토큰당)를 유지했습니다. 큰 코드베이스와 긴 문서를 다루는 코딩 에이전트·업무 자동화 사용자에게 의미가 큰 업데이트입니다.

핵심 사실 · 한눈에 보기

  • 2월 5일 공개됐고, claude.ai·Claude API·주요 클라우드에서 바로 쓸 수 있습니다(API 모델명 claude-opus-4-6).
  • Opus 계열 첫 100만 토큰 맥락(베타, Claude Developer Platform 한정)과 최대 128k 토큰 출력을 지원합니다.
  • 출시 가격은 100만 토큰당 입력 5달러·출력 25달러로 이전과 같았고, 당시엔 20만 토큰을 넘는 프롬프트에 10달러·37.5달러가 적용됐습니다.
  • 생각의 깊이를 정하는 effort가 4단계(low·medium·high·max)로 나뉘고, 기본값은 high입니다.
  • Claude Code에 여러 에이전트가 팀으로 일하는 'agent teams'가 연구 프리뷰로 추가됐습니다.

무엇이 나왔나

Anthropic은 2월 5일 Claude Opus 4.6을 공개했습니다. 회사 설명의 중심은 코딩입니다. 작업을 더 신중하게 계획하고, 에이전트 작업을 더 오래 이어가며, 큰 코드베이스에서도 더 안정적으로 움직이고, 자기 실수를 잡는 코드 리뷰·디버깅 능력이 좋아졌다는 것입니다.

코딩 밖으로는 재무 분석, 리서치, 문서·스프레드시트·발표 자료 작업을 예로 들었습니다. 같은 날 Claude in Excel 개선과 Claude in PowerPoint 연구 프리뷰도 함께 발표했습니다.

이전 Opus와 달라진 점

직전 모델은 Opus 4.5입니다. Opus 계열은 지금까지 100만 토큰 맥락을 지원하지 않았고, '확장 사고(extended thinking)'는 켜거나 끄는 두 가지 선택만 있었습니다. Opus 4.6에서는 모델이 상황을 보고 생각을 얼마나 깊게 할지 정하는 '적응형 사고'가 들어왔고, 개발자가 effort를 네 단계로 조절할 수 있게 됐습니다.

  • 맥락: Opus 첫 100만 토큰(베타). 단, Claude Developer Platform에서만 제공
  • 출력: 한 번에 최대 128k 토큰
  • 긴 작업: 맥락이 한도에 가까워지면 오래된 내용을 자동 요약하는 context compaction(베타)
  • 미국 내 처리: 미국 안에서만 추론하는 옵션은 토큰 가격의 1.1배

회사가 내세운 성능 (Anthropic 발표 기준)

아래 수치는 모두 Anthropic이 발표한 결과입니다. 이 중 GDPval-AA는 외부 기관 Artificial Analysis가 측정했다고 밝혔습니다.

  • 에이전트 코딩 평가 Terminal-Bench 2.0에서 최고 점수
  • 금융·법률 등 실무 과제 평가 GDPval-AA에서 OpenAI GPT-5.2보다 약 144 Elo, 이전 Opus 4.5보다 190 Elo 높음
  • 100만 토큰 속 정보 8개를 찾는 MRCR v2 시험에서 76% (Sonnet 4.5는 18.5%)
  • Humanity's Last Exam(도구 사용) 점수는 2월 23일 부정행위 탐지 개선 후 53.1%에서 53.0%로 정정

AI마중 POINT · 해석

봐야 할 지점

가격을 그대로 두고 성능을 올렸지만, 실제 비용은 '얼마나 오래 생각하게 하느냐'에 따라 달라집니다. Anthropic 스스로도 Opus 4.6이 쉬운 작업에서 과하게 생각해 비용과 지연이 늘 수 있다며, 그럴 땐 effort를 기본값(high)에서 medium으로 낮추라고 권했습니다. 같은 모델이라도 설정에 따라 체감 가격이 달라지는 구조입니다.

또 하나는 긴 맥락의 '품질'입니다. 대화가 길어질수록 성능이 떨어지는 문제를 줄였다는 MRCR 결과는, 큰 코드베이스나 수백 쪽 문서를 다루는 작업에서 의미가 있습니다. 이 사이트 기록상 같은 날 OpenAI도 코딩 에이전트용 GPT-5.3-Codex를 발표해, 2026년 코딩 모델 경쟁이 같은 날 맞붙는 형태로 시작됐습니다.

그래서 나한테는?

실제로 쓰는 사람에게

  • 개발자: 쉬운 작업은 effort를 낮춰 비용을 줄이고, 긴 작업에는 context compaction을 켜볼 수 있습니다. 출시 당시 100만 토큰은 베타였고 20만 토큰을 넘으면 단가가 올랐지만, 3월 12일 정식 제공으로 바뀌며 100만 토큰 전체에 표준 가격이 적용됐습니다.
  • 직장인: 엑셀에서 정리한 데이터를 파워포인트 슬라이드로 옮기는 흐름을 Claude에 맡길 수 있습니다. 단 PowerPoint 기능은 Max·Team·Enterprise 요금제의 연구 프리뷰입니다.
  • 일반 사용자: claude.ai에서 모델을 바꿔 쓸 수 있습니다. 실제 체감은 작업 난도에 따라 다릅니다.

미확인 · 공식 발표만으로 알 수 없는 것

발표만으로는 알 수 없는 것

  • 벤치마크 대부분은 Anthropic이 직접 돌린 결과입니다. 실제 업무에서 같은 차이가 나는지는 사용자가 확인해야 합니다.
  • 출시 당시 100만 토큰 맥락은 Claude Developer Platform 한정 베타였습니다. 이 사이트 기록상 3월 12일 Opus 4.6·Sonnet 4.6의 100만 토큰 맥락이 정식 제공되며 긴 맥락 할증이 없어졌습니다.
  • 한국어 작업 성능은 따로 발표되지 않았습니다.

SOURCE공식 원문 확인

  • PRIMARY · 공식Claude Opus 4.6Anthropic · anthropic.com · 발표 2026.02.05 · 확인 2026.10.05

추가 확인 자료 · 편집자가 직접 대조한 공식 문서

  • PricingClaude API 문서 · platform.claude.com · 확인 2026.10.02확인한 내용: 현재 긴 맥락 가격 정책(4.6 이후 100만 토큰 표준 가격), 4.7 이후 토크나이저 토큰 증가

수집 2026.09.30 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

같은 주제 · Anthropic

Anthropic 전체 →