TL;DR

  • OpenAI가 유럽연합(EU)의 모든 요금제 중 대상 ChatGPT·Codex 사용자에게 머신 판독이 가능한 텍스트 워터마킹(textGrain)을 순차 도입하지만, 출시 시점에 전 세계 기본값으로 설정하지는 않음.
  • OpenAI는 textGrain이 Google DeepMind의 텍스트용 SynthID 같은 다른 방식과 비교해 성능이 같거나 더 뛰어났다고 밝힘.
  • OpenAI가 공개한 벤치마크에서는 워터마크가 있는 텍스트와 없는 텍스트의 성능이 비슷하지만, 워터마크는 신뢰할 수 있는 탐지를 보장하지 않음.
  • 전 세계 API 고객은 일부 모델의 출력에 워터마크를 선택적으로 적용할 수 있으며, 클라우드 파트너 서비스에서도 몇 주 안에 이용할 수 있도록 작업 중임.
  • 승인된 연구자와 전문 기관은 탐지 도구 이용을 신청할 수 있으며, 도구는 OpenAI 워터마크 탐지 여부만 알리고 사용자의 신원이나 대화 내용은 공개하지 않음.

EU에서 ChatGPT와 Codex에 도입되는 텍스트 워터마킹

  • ChatGPT와 Codex의 텍스트 출력에 보이지 않는 머신 판독형 워터마크가 도입되며, 초기 적용 대상은 유럽연합 사용자로 한정됨.
  • OpenAI는 앞으로 몇 주 동안 EU 내 대상 ChatGPT·Codex 사용자의 모든 요금제에 textGrain 워터마킹을 적용할 예정임.

출시 시점에 텍스트 워터마킹을 전 세계 기본값으로 설정하지 않음. 지역별 접근 방식으로 실제 사용과 피드백을 살펴볼 여지를 확보함.

  • OpenAI는 textGrain이 Google DeepMind의 텍스트용 SynthID를 비롯한 다른 접근 방식과 비교해 성능이 “같거나 더 뛰어났다”고 밝힘.
  • Anthropic도 8월에 발표한 워터마킹을 EU 인공지능법(AI Act) 요건 충족을 위해 도입했지만, 도입 소식에 모두가 만족한 것은 아님.

워터마크의 성능과 한계

  • OpenAI가 제시한 인공지능 벤치마크 점수에서는 워터마크가 적용된 텍스트와 적용되지 않은 텍스트의 성능이 비슷함.
  • OpenAI는 textGrain이 “신뢰할 수 있는 탐지를 보장하지 않는다”고 밝힘.
  • 텍스트 워터마크만으로는 정확성을 검증하거나 텍스트의 소유자를 판별할 수 없으며, 사람이 기여한 정도를 측정하거나 사람이 작성했음을 입증할 수도 없음.

API 고객의 선택 적용과 클라우드 서비스

  • 오늘부터 전 세계 API 고객은 일부 모델의 텍스트 출력에 워터마크를 선택적으로 적용할 수 있음.
  • 고객은 워터마킹을 투명성 의무와 사용자에게 제공하는 경험에 어떻게 반영할지 결정할 수 있음.
  • OpenAI는 클라우드 파트너와 협력해 해당 서비스를 통해 이용하는 OpenAI 모델 출력에도 몇 주 안에 워터마킹을 제공할 계획임.

연구자와 전문 기관의 탐지 도구 접근

  • 승인된 연구자와 전문 기관은 오늘부터 도구 이용을 신청할 수 있음.
  • 실천 강령(Code of Practice)에 따라 초기 접근은 텍스트 출처 정보의 평가와 개선을 지원하도록 사례별로 허용됨.
  • 도구는 OpenAI 워터마크를 탐지했는지만 표시하며, 사용자 신원이나 프롬프트·대화 내용은 공개하지 않음.
  • 워터마크를 놓치는 경우와 오탐 가능성을 고려해 출시 시점에는 도구를 대중에게 공개하지 않음.