본문으로 건너뛰기

← 2026.03.06 뉴스레터

2026.03.06 발표 · Anthropic

SECURITY (보안·안전)

Claude Opus 4.6, 2주 만에 Firefox 취약점 22개 발견

Anthropic과 Mozilla가 함께 진행한 시험에서 Claude Opus 4.6이 2주 동안 Firefox 취약점 22개를 찾았습니다. Mozilla가 심각도 '높음'으로 분류한 것이 14개로, 2025년 한 해 동안 고친 Firefox 고위험 취약점의 약 5분의 1에 해당합니다. 반면 찾은 취약점을 실제 공격 코드로 만드는 데는 수백 번 시도 중 두 번만 성공했습니다.

핵심 사실 · 한눈에 보기

  • 3월 6일 Anthropic이 Mozilla와의 협력 결과를 공개했습니다. Claude Opus 4.6이 2월 중 2주 동안 Firefox 취약점 22개를 찾았습니다.
  • Mozilla는 이 가운데 14개를 심각도 '높음'으로 분류했습니다. 2025년에 고친 Firefox 고위험 취약점의 약 5분의 1 규모입니다.
  • C++ 파일 약 6천 개를 살펴 112건의 고유 보고서를 제출했고, 대부분은 Firefox 148에서 수정됐습니다.
  • 찾은 취약점으로 공격 코드를 만드는 시험은 약 4천 달러어치 API 크레딧을 들여 수백 번 돌렸고, 성공은 두 번이었습니다.
  • 그 공격 코드도 브라우저 샌드박스 같은 보안 기능을 일부러 뺀 시험 환경에서만 작동했습니다.

어떻게 찾았나

출발점은 평가였습니다. Anthropic은 2025년 말 Opus 4.5가 알려진 취약점을 재현하는 벤치마크(CyberGym)를 거의 다 풀자, 더 어려운 시험으로 Firefox의 과거 취약점(CVE)을 재현하게 했습니다. 그런데 과거 취약점은 학습 데이터에 들어 있었을 수 있어, 아직 보고된 적 없는 현재 버전의 새 취약점을 찾게 했습니다.

Claude는 자바스크립트 엔진을 20분쯤 살펴본 뒤 메모리 취약점(Use After Free)을 보고했고, 연구자 세 명이 따로 검증한 뒤 Claude가 쓴 패치 후보와 함께 Mozilla 버그 추적 시스템에 올렸습니다. 이를 검증하는 사이 Claude는 고유한 충돌 입력을 50개 더 찾았고, Mozilla 측 연구자가 하나하나 검증하지 말고 한꺼번에 보내 달라고 요청했다고 합니다.

찾기와 악용 사이의 차이

Anthropic은 Claude가 실제 공격 도구까지 만들 수 있는지도 시험했습니다. 제출한 취약점을 주고 대상 시스템의 로컬 파일을 읽고 쓰는 실제 공격을 보이라는 과제였습니다. 수백 번 돌린 결과 성공은 두 번이었습니다.

회사는 여기서 두 가지를 읽었습니다. Claude는 취약점을 찾는 데 비해 악용하는 데는 훨씬 서툴고, 찾는 비용이 공격 코드를 만드는 비용보다 한 자릿수 이상 싸다는 것입니다. 다만 거칠게나마 자동으로 브라우저 공격 코드를 만든 사례가 있다는 사실 자체는 '우려스럽다'고 직접 밝혔습니다.

AI마중 POINT · 해석

봐야 할 지점

Firefox는 세계에서 가장 많이 시험받는 오픈소스 중 하나입니다. 그런 코드에서 2주 만에 1년치 고위험 취약점의 5분의 1에 해당하는 숫자가 나왔다는 것은, 취약점을 찾는 속도가 사람 중심 방식과 다른 단계로 넘어갔다는 뜻입니다. Anthropic이 '최첨단 언어 모델은 이제 세계 수준의 취약점 연구자'라고 쓴 이유입니다.

회사의 결론은 '지금은 방어자에게 유리한 창'이라는 것입니다. 찾는 능력이 악용 능력보다 앞서 있는 동안 방어자가 먼저 찾아 고쳐야 한다는 논리이고, 이 격차가 오래가지 않을 것이라고 봤습니다. 이 사이트 기록상 이 흐름은 이후 Anthropic의 사이버 안전장치 강화와 Claude Fable 5 관련 조치로 이어졌습니다.

그래서 나한테는?

누구에게 무엇이 남나

  • 일반 사용자: 이번에 찾은 취약점 대부분은 Firefox 148에서 고쳐졌습니다. 브라우저 업데이트를 미루지 않는 것이 가장 직접적인 대응입니다.
  • 오픈소스 관리자: Mozilla가 AI 기반 보고서를 믿을 수 있었던 이유로 꼽은 것은 최소 재현 사례, 자세한 개념 증명(PoC), 패치 후보 세 가지였습니다. AI로 찾은 버그를 보고하거나 받을 때 기준으로 삼을 만합니다.
  • 보안 담당자: AI가 만든 패치는 '버그가 실제로 사라졌는지'와 '원래 기능이 그대로인지'를 따로 검증해야 한다고 Anthropic은 권했습니다.

미확인 · 공식 발표만으로 알 수 없는 것

남은 질문

  • 112건 보고서 중 보안과 무관하다고 판정된 건수는 공개되지 않았습니다.
  • Anthropic은 리눅스 커널 등 다른 프로젝트에서도 취약점을 찾았다고 밝혔지만, 이 글에는 세부 내용이 없습니다.

SOURCE공식 원문 확인

수집 2026.09.30 · 정리 2026.10.01 · 수정 2026.10.05 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

같은 주제 · Anthropic

Anthropic 전체 →