본문으로 건너뛰기

← 2026.10.05 뉴스레터

2026.10.05 발표 · OpenAI

REGULATION (규제·정책)

ChatGPT가 쓴 글에 '보이지 않는 워터마크'… 단어 25% 바꾸자 탐지율 17%

OpenAI가 AI 생성 텍스트에 보이지 않는 통계적 신호를 넣는 textGrain을 공개했습니다. API 고객은 일부 모델에서 선택적으로 쓸 수 있고, EU에서는 앞으로 몇 주 동안 대상 ChatGPT·Codex 출력에 적용됩니다. 다만 OpenAI 자체 실험에서도 단어를 바꿔 쓰자 탐지율이 크게 떨어져, 워터마크만으로 AI 작성 여부를 단정할 수 없다는 한계도 확인됐습니다.

핵심 사실 · 한눈에 보기

  • OpenAI의 textGrain은 모델의 단어 선택에 보이지 않는 통계적 신호를 넣고, 탐지기가 그 신호를 찾는 방식입니다.
  • 10월 5일부터 전 세계 API 고객은 일부 모델에서 텍스트 워터마크를 선택적으로 쓸 수 있으며, API 기본값은 꺼짐입니다.
  • OpenAI는 앞으로 몇 주 동안 EU의 대상 ChatGPT·Codex 텍스트 출력에 워터마크를 적용하며, 출시 시점에는 전 세계 기본 적용을 하지 않습니다.
  • 400토큰 영어 텍스트 실험에서 단어 10%를 동의어로 바꾸자 탐지율이 약 92%에서 66%로, 25%를 바꾸자 17%로 떨어졌습니다.
  • 워터마크 탐지기는 출시 시점에 일반 공개하지 않고, 승인된 연구자와 전문기관에 우선 제공합니다.

무슨 일이 있었나

OpenAI가 10월 5일 EU AI Act의 텍스트 출처 표시 규칙에 대응해 AI 생성 텍스트 워터마킹 기술인 textGrain과 적용 계획을 공개했습니다.

이미지나 오디오 파일에 출처 정보를 남기는 것과 달리 텍스트는 복사하거나 다시 쓰기 쉽습니다. OpenAI는 생성되는 문장의 단어 선택에 사람이 볼 수 없는 통계적 신호를 넣고, 별도의 탐지기로 그 신호를 확인하는 방식을 씁니다.

어디에 적용되나

API 고객은 10월 5일부터 전 세계에서 일부 지원 모델의 텍스트 워터마크를 선택적으로 켤 수 있습니다. 기본값은 꺼져 있습니다.

일반 ChatGPT와 Codex에서는 앞으로 몇 주 동안 EU의 대상 텍스트 출력에 적용됩니다. OpenAI는 출시 단계에서 이를 전 세계 기본 기능으로 적용하지 않는다고 밝혔습니다.

따라서 이번 발표를 한국 ChatGPT 사용자의 모든 답변에 즉시 워터마크가 적용되는 변화로 해석하면 안 됩니다.

textGrain은 어떻게 작동하나

textGrain은 모델이 문장을 만들 때 고르는 단어에 보이지 않는 통계적 신호를 넣습니다. 탐지기는 해당 문장에 OpenAI 워터마크 신호가 있는지를 평가합니다.

OpenAI는 자체 평가에서 textGrain이 SynthID for text를 포함해 시험한 다른 접근법과 같거나 더 높은 성능을 보였다고 설명했습니다.

다만 이는 OpenAI 자체 평가 결과이며, 이상적인 조건의 성능이 실제 환경에서 같은 탐지 신뢰도를 보장하지는 않는다고 OpenAI도 명시했습니다.

단어를 바꾸자 탐지율이 크게 떨어졌다

가장 중요한 한계는 텍스트를 수정하면 워터마크 신호가 약해질 수 있다는 점입니다.

OpenAI가 워터마크를 넣은 400토큰 길이의 영어 응답으로 실험한 결과, 단어 10%를 동의어로 바꿨을 때 탐지율은 약 92%에서 66%로 떨어졌습니다. 25%를 바꿨을 때는 17%까지 낮아졌습니다.

짧은 글도 더 어렵습니다. 목표 오탐률 1% 조건에서 심리학 분야 200토큰 텍스트의 탐지율은 약 80%, 400토큰은 약 95%였습니다. 수학처럼 쓸 수 있는 단어 선택의 폭이 작은 분야에서는 탐지율이 더 낮았습니다.

워터마크가 알려주지 못하는 것

OpenAI는 워터마크가 발견됐다고 해서 글의 작성자나 소유자, 정확성을 알 수 있는 것은 아니라고 강조합니다.

워터마크는 OpenAI 시스템이 해당 텍스트의 일부를 생성하거나 처리했다는 신호가 될 수 있지만, 사람이 얼마나 수정했는지나 누가 썼는지는 알려주지 않습니다.

반대로 워터마크가 발견되지 않았다고 사람이 직접 쓴 글이라고 단정할 수도 없습니다. 짧은 글이거나, 수정·번역됐거나, 지원하지 않는 모델에서 생성됐다면 탐지되지 않을 수 있기 때문입니다.

왜 탐지기를 모두에게 공개하지 않나

OpenAI는 워터마크 탐지기 접근을 우선 승인된 연구자와 전문기관에만 제공합니다. 탐지 실패와 오탐 가능성이 있는 상황에서 결과가 잘못 해석될 위험이 있기 때문입니다.

탐지기는 OpenAI 워터마크가 발견됐는지를 알려주지만, 사용자의 신원이나 프롬프트, 대화 내용은 공개하지 않습니다.

기존 흐름과 무엇이 다른가

OpenAI는 이미 이미지와 오디오에 Content Credentials, C2PA, SynthID와 검증 도구를 써 왔습니다. 이번 발표의 핵심은 이 출처 확인 체계가 텍스트로 넓어진다는 점입니다.

AI마중 POINT · 해석

AI마중 POINT

AI가 쓴 글을 기술 하나로 완벽하게 가려낼 수 있는 단계는 아닙니다. 오히려 이번 발표에서 눈여겨볼 부분은 OpenAI가 워터마크를 도입하면서 동시에 그 한계를 구체적인 수치로 공개했다는 점입니다. 특히 단어 25%를 바꿨을 때 탐지율이 17%까지 떨어진 결과는 'AI 탐지됨'과 'AI 탐지 안 됨'을 사람의 작성 여부를 판정하는 절대적인 증거처럼 써서는 안 되는 이유를 보여줍니다.

그래서 나한테는?

한국 사용자에게는

현재 발표만 보면 한국의 일반 ChatGPT 사용자에게 즉시 워터마크가 적용되는 것은 아닙니다. 일반 ChatGPT·Codex 적용 범위는 EU로 발표됐습니다.

다만 API 고객의 선택 적용(opt-in)은 전 세계 대상이기 때문에, 국내 개발사나 서비스 운영자가 지원 모델에서 워터마크를 선택할 수 있는 길은 열렸습니다.

또 교육이나 채용, 콘텐츠 검증 과정에서 AI 탐지 결과를 어떻게 받아들여야 하는지에도 의미가 있습니다. OpenAI가 공개한 수치 자체가, 텍스트를 수정하는 것만으로 탐지 성능이 크게 달라질 수 있음을 보여주기 때문입니다.

미확인 · 공식 발표만으로 알 수 없는 것

아직 확인할 부분

OpenAI는 textGrain 기술 보고서를 앞으로 추가 정보와 함께 업데이트하고, 향후 오픈소스로 공개할 계획이라고 밝혔습니다.

실제 EU 환경에서 수정·번역된 텍스트의 탐지 성능이 어느 정도인지, 탐지기 접근 범위가 언제 넓어지는지는 앞으로 확인해야 합니다.

SOURCE공식 원문 확인

수집 2026.10.06 · 정리 2026.10.06 · 원문 본문은 옮기지 않았습니다. 회사가 밝힌 수치·성능은 본문에서 출처를 붙여 구분했습니다.

같은 주제 · OpenAI

OpenAI 전체 →