OpenAI가 EU부터 ChatGPT와 Codex에 텍스트 워터마크를 심는다
OpenAI가 ChatGPT와 Codex가 내놓는 텍스트에 사람 눈에는 보이지 않지만 기계는 읽을 수 있는 워터마크를 심기 시작했다. 워터마크 이름은 textGrain이며, 첫 적용 대상은 유럽연합(EU) 사용자다.
EU에서는 모든 요금제의 ChatGPT와 Codex 사용자에게 향후 몇 주에 걸쳐 순차적으로 적용된다. 다만 이번 출시에서 워터마크가 전 세계 기본값이 되지는 않는다. OpenAI는 지역 단위로 먼저 적용해 실제 사용과 피드백을 관찰할 여지를 두겠다는 입장이다.
API 쪽은 방식이 다르다. 전 세계 API 고객은 오늘부터 일부 모델에 한해 워터마크가 들어간 텍스트 출력을 선택(옵트인)할 수 있다. 고객이 자신의 투명성 의무와 사용자 경험에 맞춰 워터마크 적용 여부를 결정하게 하겠다는 것이다. 클라우드 파트너를 통해 접근하는 OpenAI 모델 출력에도 몇 주 안에 같은 기능이 제공될 예정이다.
배경에는 EU AI Act가 있다. Anthropic도 지난 8월 같은 규제 요구를 충족하기 위해 텍스트 워터마크를 발표했고, 그 기반이 된 것은 Google DeepMind의 SynthID for text다. OpenAI는 자사 textGrain이 SynthID 같은 다른 접근과 비교해 동등하거나 더 나은 성능을 냈다고 설명한다.
품질 저하 우려에 대해서는 AI 벤치마크 점수를 함께 공개했다. 워터마크가 들어간 텍스트와 그렇지 않은 텍스트의 성능이 비슷했다는 결과다.
탐지 도구는 아직 일반에 공개되지 않는다. 승인된 연구자와 전문 기관이 오늘부터 신청할 수 있고, Code of Practice에 따라 초기에는 사례별로 접근 권한이 부여된다. 이 도구는 OpenAI 워터마크 검출 여부만 알려주며, 사용자를 식별하거나 프롬프트·대화 내용을 노출하지 않는다. 워터마크를 놓치거나 없는 것을 있다고 판정하는 오류 위험 때문에 출시 시점에 공개 배포는 하지 않는다.
개발자 입장에서 가장 직접적인 변화는 API 옵트인이다. EU 규제 대응이 필요한 서비스라면 모델 출력에 워터마크를 붙이는 선택지가 생겼고, 자체 파이프라인에서 투명성 요구를 어떻게 충족할지 설계할 수 있게 됐다. 클라우드 파트너 경유 출력까지 지원되면 모델 호출 경로와 무관하게 같은 정책을 적용할 수 있다.
한계도 분명하다. OpenAI는 textGrain이 안정적인 탐지를 보장하지 않는다고 명시한다. 텍스트 워터마크는 내용의 정확성을 검증하지 않고, 텍스트 소유권을 정하지도 않으며, 사람이 얼마나 기여했는지 측정하거나 인간이 작성했다는 사실을 증명하지도 않는다. 검출 결과를 저작권이나 표절 판단의 근거로 삼아서는 안 된다는 뜻이다.