OpenAI will start watermarking ChatGPT's text in the EU
Quick Summary
OpenAI는 EU AI Act 준수를 위해 EU의 ChatGPT·Codex에 보이지 않는 텍스트 워터마크를 도입하며, 전 세계 API에는 선택적으로 제공하지만 편집에 따른 탐지 한계와 인간 기여를 판단할 수 없다는 점을 강조했다.
🖼️ 인포그래픽

🖼️ 4컷 인포그래픽

💡 한 줄 요약
OpenAI는 EU AI Act 준수를 위해 EU의 ChatGPT·Codex에 보이지 않는 텍스트 워터마크를 도입하며, 전 세계 API에는 선택적으로 제공하지만 편집에 따른 탐지 한계와 인간 기여를 판단할 수 없다는 점을 강조했다.
📌 핵심 요약
- OpenAI는 2026년 10월 5일 발표에서, 8월 2일 발효된 EU AI Act의 투명성 규칙에 따라 향후 몇 주 동안 EU의 모든 요금제에서 적용 대상 ChatGPT·Codex 사용자에게 텍스트 워터마크를 도입한다고 밝혔다.
- 전 세계 OpenAI API 개발자는 발표 당일부터 일부 모델에서 워터마크를 켤 수 있으며, 기본값은 비활성화다. OpenAI는 출시 시점에 텍스트 워터마크를 전 세계 기본 설정으로 적용하지 않는다.
- 워터마크는 단어 선택을 미세하게 조정해 복사·붙여넣기 후에도 남는 보이지 않는 패턴을 만든다. OpenAI는 사용자 신원을 식별하지 않으며 모델 성능에도 의미 있는 변화가 없었다고 밝혔다. 기술 보고서의 방법명은 textGrain이다.
- OpenAI의 한 실험에서는 단어 10%를 동의어로 바꾸자 탐지율이 약 92%에서 66%로 하락했다. 짧은 구절·수학 답변·번역된 텍스트도 탐지가 어렵다. 초기 탐지기 접근은 승인된 연구자와 전문 기관에 제한되며, 워터마크 부재는 인간 작성의 증거가 아니고 존재 여부도 인간의 판단·편집·창의성 기여 정도를 알려주지 않는다.
- Anthropic은 두 달 전 Claude 텍스트에 워터마크를 전 세계적으로 적용하겠다고 발표했으며, 일부 사용자는 자신들이 지시·맥락·결정을 제공했다며 반발했다. The Wall Street Journal은 2024년 OpenAI가 비워터마크 경쟁 서비스로의 사용자 이탈 우려 등을 이유로 기존 워터마크 공개를 보류했다고 보도했다. Anthropic·Google·Meta·Microsoft·OpenAI는 AI 생성 콘텐츠에 관한 EU 실천규범 준수를 약속한 기업들이다.
🧩 주요 포인트
- EU 규제 대응과 지역별 적용 차이 → ChatGPT·Codex의 EU 도입과 OpenAI API의 선택적 활성화를 구분해 적용 범위를 이해해야 한다.
- textGrain의 복사·붙여넣기 지속성과 편집에 따른 탐지율 하락 → 워터마크는 출처 식별 단서이지만 모든 텍스트에서 동일한 탐지 신뢰성을 보장하지 않는다.
- Claude 사용자 반발과 OpenAI의 과거 공개 보류 → 워터마크 도입에는 투명성 확보뿐 아니라 인간 기여의 해석과 사용자 이탈 우려가 함께 작용한다.
🧠 상세 정리
1. EU 투명성 규칙에 따른 도입
OpenAI는 2026년 10월 5일 블로그 발표를 통해 유럽연합에서 ChatGPT와 Codex가 생성하는 텍스트에 보이지 않는 워터마크를 추가하겠다고 밝혔다. 회사가 제시한 도입 이유는 EU AI Act 준수이며, 해당 법의 투명성 규칙은 8월 2일부터 효력이 발생했다. 이 규칙은 AI 기업이 생성 콘텐츠를 다른 시스템에서 식별할 수 있는 방식으로 표시하도록 요구한다. 따라서 이번 발표의 핵심은 사람이 눈으로 확인하는 표식을 붙이는 것이 아니라, 다른 시스템이 AI 생성 콘텐츠를 알아볼 수 있는 신호를 텍스트에 넣는 데 있다. 기사는 이러한 규제 요구를 출발점으로 적용 범위, 작동 방식, 탐지 한계를 설명한다.
2. ChatGPT·Codex와 API의 적용 범위
워터마크는 향후 몇 주 동안 EU의 모든 요금제에서 적용 대상 ChatGPT·Codex 사용자에게 순차적으로 도입될 예정이다. 모든 요금제가 포함된다는 설명과 함께, 초기 서비스 도입 지역은 EU로 한정된다는 조건이 제시됐다. 반면 OpenAI API를 사용하는 개발자는 세계 어느 지역에서든 발표 당일부터 일부 모델에 대해 워터마크를 활성화할 수 있다. API에서는 워터마크가 기본적으로 꺼져 있으므로, 이용 가능 지역이 전 세계라는 사실과 기본 활성화 여부는 구분해야 한다. OpenAI는 출시 시점에 텍스트 워터마크를 전 세계의 기본 설정으로 만들지 않겠다고 명시해, EU 서비스 도입과 전 세계 개발자의 선택적 사용 사이에 차이를 뒀다.
3. 단어 선택에 패턴을 남기는 textGrain
워터마크는 실제 기호를 삽입하는 방식이 아니라 모델의 단어 선택을 미세하게 조정해 독자에게 보이지 않는 패턴을 남기는 방식으로 작동한다. 패턴이 단어 자체에 들어 있으므로 텍스트를 복사해 붙여넣어도 함께 이동하며, 탐지기는 이를 감지할 수 있다. OpenAI는 이 표시가 사용자 신원을 식별하지 않고, 활성화한 상태에서도 모델 성능에 의미 있는 변화가 관찰되지 않았다고 설명했다. 회사는 펜실베이니아대학교와 예일대학교 연구자들과 공동 작성한 textGrain 기술 보고서도 발표했다. 보고서는 비밀 키로 다음 단어 예측을 분류해 문장을 완성하는 예시를 제시하며, 이런 작은 조정이 수백 번 누적되면 텍스트와 키만으로 AI 생성 콘텐츠를 탐지할 수 있다고 설명한다.
4. 편집과 텍스트 유형에 따른 탐지 한계
기사는 편집으로 워터마크를 제거할 수 있는지에 대해 OpenAI의 시험 결과가 그 가능성을 보여준다고 전한다. 한 실험에서 단어의 10%를 동의어로 바꾸자 탐지율은 약 92%에서 66%로 떨어졌다. 이 수치는 특정 실험의 결과이며, 모든 편집 방식이나 모든 텍스트에 동일하게 적용되는 탐지율로 제시되지는 않았다. 회사는 짧은 구절, 수학 답변, 번역된 텍스트도 탐지하기 더 어렵다고 밝혔다. OpenAI는 이러한 한계가 초기 탐지기 접근을 승인된 연구자와 전문 기관에만 제공하기로 한 결정에 영향을 줬다고 설명했으며, 이들이 신뢰성과 책임 있는 활용을 평가하는 데 도움을 줄 수 있다고 덧붙였다.
5. 워터마크로 판단할 수 있는 것과 인간의 기여
OpenAI는 워터마크가 없다고 해서 사람이 작성했다는 사실이 입증되는 것은 아니라고 경고했다. 텍스트가 너무 짧거나 심하게 편집됐을 수 있으며, 다른 회사의 AI가 만든 결과물일 가능성도 있기 때문이다. 반대로 워터마크가 감지되면 OpenAI 시스템이 구절의 일부를 생성하거나 처리했다는 단서가 될 수 있지만, 인간의 판단·편집·창의성이 얼마나 들어갔는지는 알 수 없다. 이 구분은 두 달 앞서 Claude 생성 텍스트에 워터마크를 전 세계적으로 적용하겠다고 발표한 Anthropic 사례와 연결된다. 일부 Claude 사용자는 지시와 맥락, 결정을 자신들이 제공했고 Claude는 도구였을 뿐이라고 반발했으며, 이는 AI 관여 표시와 인간 기여의 평가가 서로 다른 문제임을 보여준다.
6. 과거 공개 보류와 업계의 규범 참여
이번 발표에 앞서 OpenAI는 이미 텍스트 워터마크를 개발했지만 공개를 보류한 적이 있었다. The Wall Street Journal은 2024년 그 이유 중 하나로 사용자가 워터마크를 적용하지 않는 경쟁 서비스로 이동할 수 있다는 우려를 보도했다. 기사는 이 과거 판단을 소개해, 현재의 도입 결정 배경에 규제 준수뿐 아니라 사용자 반응과 경쟁 서비스에 대한 고려도 있었음을 드러낸다. Anthropic의 전 세계 적용 발표와 OpenAI의 EU 중심 초기 도입은 기사에서 서로 다른 적용 범위로 제시된다. 끝으로 기사는 Anthropic, Google, Meta, Microsoft, OpenAI가 AI 생성 콘텐츠에 관한 EU 실천규범을 따르겠다고 약속한 기업들에 포함된다고 전하며 업계의 규범 참여 맥락을 덧붙인다.
🧾 핵심 주장 / 시사점
- EU의 ChatGPT·Codex 도입과 전 세계 OpenAI API의 선택적 활성화는 서로 다른 적용 방식이므로, 제품·지역·기본 설정을 함께 봐야 도입 범위를 정확히 이해할 수 있다.
- 복사·붙여넣기 후에도 패턴이 남는 특성과 동의어 치환으로 탐지율이 낮아지는 특성은 양립하며, 워터마크의 지속성이 편집에 대한 강한 내성을 뜻하지는 않는다.
- 워터마크는 OpenAI 시스템의 관여를 나타내는 단서지만 인간 기여의 크기를 설명하지 못하므로, Claude 사용자 반발을 단순한 탐지 정확도 문제로만 해석하기 어렵다.
✅ 액션 아이템
- EU의 ChatGPT·Codex 도입 범위와 OpenAI API의 기본 비활성화 조건을 구분해 이용 방식 검토.
- 단어 10%의 동의어 치환 시 탐지율이 약 92%에서 66%로 하락한 결과와 짧은 구절·수학 답변·번역된 텍스트의 한계를 반영해 탐지 결과 해석.
- Claude 사용자 반발과 워터마크의 인간 기여 판별 한계를 함께 고려해 AI 관여 표시의 의미 검토.
❓ 열린 질문
- EU의 ChatGPT·Codex 사용자 중 구체적으로 어떤 사용자가 워터마크 적용 대상에 포함되는가?
- 단어 10%의 동의어 치환으로 탐지율이 약 92%에서 66%로 낮아지는 조건에서 탐지 결과의 신뢰성을 어떻게 평가할 수 있는가?
- 워터마크가 인간의 판단·편집·창의성 기여 정도를 알려주지 못하는 상황에서 Claude 사용자들이 주장한 인간의 기여를 어떻게 해석해야 하는가?