인공지능
OpenAI가 텍스트 워터마크를 내놨다. 기본 적용은 EU뿐이고, 검출기는 승인된 소수만 받는다
OpenAI의 워터마크 기술 textGrain은 10월 5일부터 EU의 ChatGPT와 Codex에 자동 적용되고, 그 밖의 지역에서는 선택 사항으로 남았다. 공개된 검출률이 보여주는 것은 읽히는 것은 견디지만 편집은 견디지 못하는 신호다. 게다가 검출기는 신청제다.
MAI
OpenAI는 10월 5일 텍스트 출력에 워터마크를 넣기 시작했다. 그리고 이 기능을 내놓은 방식이 기능 자체보다 더 많은 것을 말해준다. 워터마크는 유럽연합(EU)의 ChatGPT와 Codex 사용자에게는 자동으로 적용되고, API 고객에게는 전 세계 어디서나 선택 사항이며 기본값은 꺼져 있다. 그리고 그 워터마크를 읽어내는 검출기는 승인 명단 밖의 누구에게도 주어지지 않는다. 기술의 이름은 textGrain이고, OpenAI는 발표와 함께 검출률도 공개했다. 이 수치가 발표에서 가장 유용한 부분이다. 워터마크가 실제로 무엇을 해내는지를 그대로 보여주기 때문이다.
무엇이, 어디에 적용되는가
textGrain은 OpenAI의 설명대로 "모델의 단어 선택에 눈에 보이지 않는 통계적 신호"를 심는다. 문장에 똑같이 잘 맞는 단어가 여럿 있을 때, 검출기가 나중에 알아볼 수 있는 패턴에 따라 모델이 그중 하나로 기울도록 유도하는 방식이다. 눈에 보이는 출력은 달라지지 않으며, OpenAI는 테스트에서 유의미한 품질 저하를 발견하지 못했다고 밝혔다.
| 적용 대상 | 10월 5일 기준 상태 |
|---|---|
| ChatGPT·Codex (EU) | 자동 적용, "앞으로 몇 주에 걸쳐" 배포 |
| ChatGPT·Codex (EU 외) | 워터마크 없음 |
| API (일부 모델, 전 세계) | 선택 적용, 기본값 꺼짐 |
| 검출기 | 신청제. 승인된 연구자와 전문 기관에 건별 심사로 부여 |
EU만 자동 적용이라는 선 긋기는 제품상의 판단이 아니다. EU AI법(EU AI Act) 제50조는 생성형 시스템 제공자에게 합성된 출력을 기계가 읽을 수 있는 형태로 표시하도록 요구하며, 이 의무는 2026년 8월 2일부터 효력을 갖게 됐다. OpenAI는 그 의무를 부과한 관할권에서 법적 요건을 충족시키고, 나머지 사용자 기반은 그대로 두었다.
수치가 곧 본론이다
OpenAI가 직접 공개한 수치는 오탐률 1% 조건에서 측정된 것으로, 읽히는 것은 견디지만 편집은 견디지 못하는 워터마크의 모습을 보여준다.
| 조건 | 검출률 |
|---|---|
| 200토큰 분량 (단어 선택의 여지가 큰 산문) | 약 80% |
| 400토큰 분량 (동일 조건) | 약 95% |
| 단어의 10%를 유의어로 교체 | 92% → 66% |
| 단어의 25%를 유의어로 교체 | → 17% |
| 수학 등 선택의 제약이 큰 영역 | 상당히 낮음 |
코드는 더 나쁘다. OpenAI가 그 이유를 솔직하게 밝혔다. 일반 산문에 비해 다음에 올 수 있는 선택지가 적어서, 신호를 숨길 여지가 작다는 것이다. 단어의 4분의 1만 바꿔도 17%까지 떨어지는 워터마크는 동기가 있는 상대에 대한 방어가 되지 못한다. 다른 모델에 한 번 통과시키고, 문장 몇 개를 바꿔 쓰고, 사람 편집자라면 어차피 손볼 단어를 손보면 신호는 사라진다.
이것은 OpenAI가 숨기는 결함이 아니다. 회사는 이 워터마크로 인간의 기여도를 측정할 수 없고, 소유권을 확립할 수 없고, 사용자를 특정할 수 없고, 글의 내용이 사실인지 검증할 수도 없으며, 워터마크가 없다는 것이 사람이 썼다는 증거도 아니라고 명시했다. 할 수 있는 일은 검출기 접근 권한을 가진 기관에게, 편집되지 않은 특정 문단이 아마도 OpenAI 모델에서 나왔을 것이라고 알려주는 것뿐이다.
검출기가 곧 정책이다
논쟁할 만한 결정은 검출기를 공개하지 않겠다는 선택이다. OpenAI가 내세운 이유는 오탐과 미탐이 실제로 존재하며 공개된 검출기는 오용을 부른다는 것이고, 이는 방어할 수 있는 주장이다. 오탐률 1%를 대학의 모든 학생 과제물에 적용하면, 억울하게 지목되는 학생의 수는 상당하다. 그래도 결과는 달라지지 않는다. 출처 확인은 공공의 역량이 아니라 기관의 역량이 된다. 교사도, 고용주도, 법원도, 독자도 확인할 수 없다. 심사를 통과한 연구기관만이, OpenAI가 신청을 받아들일 경우 확인할 수 있다.
현재 현장에 나와 있는 다른 두 구현과 비교해 보자. Anthropic은 2026년 8월에 텍스트 워터마크를 발표하고 모델 층위에서 적용했다. Claude의 모든 제품과 모든 경로에 걸쳐 작동하며 개발자용 opt-out은 없다. Google은 텍스트용 SynthID를 이미 내놨다. OpenAI의 구현은 셋 중 가장 조건부다. 법이 요구하는 곳에서는 의무, 요구하지 않는 곳에서는 선택, 그리고 읽어낼 수 있는 경로는 회사를 통할 때뿐이다.
이를 신중함으로 볼지 편의로 볼지는 어떤 유인을 보느냐에 달려 있다. 호의적으로 읽으면, 약한 신호를 대중의 손에 넘기면 이익보다 해가 크고, OpenAI는 이 기술이 정직하게 감당할 수 있는 범위에 배포를 맞춘 셈이다. 덜 호의적으로 읽으면, 기본값이 꺼진 선택형 워터마크와 비공개 검출기의 조합은 OpenAI의 최대 고객들 — API 위에 제품을 올리고, 자기 출력이 추적 가능해지는 것을 원하지 않는 쪽 — 에게 아무런 비용도 지우지 않으면서 브뤼셀을 만족시킨다. 출시된 결과물은 두 해석 모두와 들어맞는다.
그림을 바꿀 수 있는 유일한 약속은 OpenAI가 의향을 밝힌 textGrain의 오픈소스화다. 방법이 공개되면 원칙적으로 독립적인 검출이 가능해지고, 논점은 "확인할 권한이 있는가"에서 "확인이 애초에 작동하는가"로 옮겨간다. 공개된 수치로 보면, 두 번째 질문이 여전히 더 어려운 쪽이다.
Sources: OpenAI: Text provenance in the EU · The New Stack · Unite.AI · 9to5Mac