오픈AI, EU 챗GPT·코덱 텍스트에 비가시 워터마크 도입 예고…API는 선택 적용
오픈AI가 5일 텍스트 워터마크 도입 계획을 밝혔다. EU 챗GPT·코덱에는 수주 내 적용할 예정이며, 전 세계 API 고객은 일부 모델에서 선택할 수 있다. 탐지 결과만으로 사람의 저작 여부를 판단할 수 없다.

오픈AI가 5일 유럽연합(EU)의 챗GPT·코덱 텍스트 출력에 보이지 않는 워터마크를 넣겠다고 밝혔다. 적용 대상 출력에는 수주 안에 순차 도입할 계획이다. 전 세계 API 고객은 이날부터 일부 모델에서 워터마크를 선택할 수 있지만 기본 설정은 꺼져 있다.
단어 선택에 통계적 신호…탐지기는 제한 공개
오픈AI가 공개한 기술 보고서에 따르면 ‘텍스트그레인(textGrain)’은 모델이 다음 단어 조각을 고를 때 비밀키에서 유도한 값과 선택 결과 사이에 통계적 관계를 만든다. 검사기는 생성된 텍스트와 비밀키로 이 신호를 찾는다. 눈에 보이는 표식이나 글쓴이의 신원을 기록하는 방식은 아니다.
회사는 텍스트 워터마크 탐지기 신청도 받기 시작했다. 초기 접근은 승인을 받은 연구자와 전문 기관으로 제한하며 일반인에게 공개하지 않는다. 이미지·오디오 검증 도구의 공개 범위와는 다르다.
짧거나 고친 글은 놓칠 수 있어
오픈AI 자체 평가에서 오탐 목표율을 1%로 놓았을 때 심리학 주제의 200토큰 글은 약 80%, 400토큰 글은 약 95%에서 워터마크가 검출됐다. 수학처럼 표현 선택의 폭이 좁은 글은 검출률이 더 낮았다. 이는 특정 시험 조건의 수치로 실제 모든 글에 적용되는 정확도가 아니다.
영어 문답 자료로 400토큰 글의 단어를 유의어로 바꾼 시험에서는 10%를 바꾸자 검출률이 약 92%에서 66%로, 25%를 바꾸자 17%로 낮아졌다. 따라서 신호가 없다는 검사 결과를 사람이 썼다는 증거로 볼 수 없다. 신호가 잡혀도 글의 사실 여부나 사람의 편집 기여도를 알려주지는 않는다.
EU AI법 제50조는 합성 텍스트 등을 생성하는 AI 시스템의 출력이 기계가 읽을 수 있는 방식으로 표시되고 인공 생성·조작 여부를 감지할 수 있도록 할 의무를 규정한다. 기술적으로 가능한 범위와 콘텐츠의 특성도 고려하도록 했다. 오픈AI의 이번 도입 계획은 그 의무에 대응한 것이라고 회사는 설명했다. 한국의 챗GPT·코덱 출력에 같은 설정을 기본 적용한다는 발표는 없었다.
대표 이미지: AI 생성 이미지 / 데이마크
출처: 오픈AI 2026년 10월 5일 https://openai.com/index/eu-text-provenance
기술 보고서 2026년 10월 5일 https://cdn.openai.com/pdf/e9508624-d767-41b6-a26d-e34ca798ada6/textgrain-entropy-calibrated-watermarking-for-language-model-text.pdf
EU AI Act Service Desk 제50조(2026년 7월 27일 통합본 기준) https://ai-act-service-desk.ec.europa.eu/en/ai-act/article-50


