← 전체 글

인공지능

OpenAI가 텍스트 워터마크를 내놨다. 기본 적용은 EU뿐이고, 검출기는 승인된 소수만 받는다

OpenAI의 워터마크 기술 textGrain은 10월 5일부터 EU의 ChatGPT와 Codex에 자동 적용되고, 그 밖의 지역에서는 선택 사항으로 남았다. 공개된 검출률이 보여주는 것은 읽히는 것은 견디지만 편집은 견디지 못하는 신호다. 게다가 검출기는 신청제다.

MAI
OpenAI 발표 페이지에 실린, 주황색과 분홍색의 곡선형 빛줄기를 그린 추상 이미지.

OpenAI는 10월 5일 텍스트 출력에 워터마크를 넣기 시작했다. 그리고 이 기능을 내놓은 방식이 기능 자체보다 더 많은 것을 말해준다. 워터마크는 유럽연합(EU)의 ChatGPT와 Codex 사용자에게는 자동으로 적용되고, API 고객에게는 전 세계 어디서나 선택 사항이며 기본값은 꺼져 있다. 그리고 그 워터마크를 읽어내는 검출기는 승인 명단 밖의 누구에게도 주어지지 않는다. 기술의 이름은 textGrain이고, OpenAI는 발표와 함께 검출률도 공개했다. 이 수치가 발표에서 가장 유용한 부분이다. 워터마크가 실제로 무엇을 해내는지를 그대로 보여주기 때문이다.

무엇이, 어디에 적용되는가

textGrain은 OpenAI의 설명대로 "모델의 단어 선택에 눈에 보이지 않는 통계적 신호"를 심는다. 문장에 똑같이 잘 맞는 단어가 여럿 있을 때, 검출기가 나중에 알아볼 수 있는 패턴에 따라 모델이 그중 하나로 기울도록 유도하는 방식이다. 눈에 보이는 출력은 달라지지 않으며, OpenAI는 테스트에서 유의미한 품질 저하를 발견하지 못했다고 밝혔다.

적용 대상10월 5일 기준 상태
ChatGPT·Codex (EU)자동 적용, "앞으로 몇 주에 걸쳐" 배포
ChatGPT·Codex (EU 외)워터마크 없음
API (일부 모델, 전 세계)선택 적용, 기본값 꺼짐
검출기신청제. 승인된 연구자와 전문 기관에 건별 심사로 부여

EU만 자동 적용이라는 선 긋기는 제품상의 판단이 아니다. EU AI법(EU AI Act) 제50조는 생성형 시스템 제공자에게 합성된 출력을 기계가 읽을 수 있는 형태로 표시하도록 요구하며, 이 의무는 2026년 8월 2일부터 효력을 갖게 됐다. OpenAI는 그 의무를 부과한 관할권에서 법적 요건을 충족시키고, 나머지 사용자 기반은 그대로 두었다.

수치가 곧 본론이다

OpenAI가 직접 공개한 수치는 오탐률 1% 조건에서 측정된 것으로, 읽히는 것은 견디지만 편집은 견디지 못하는 워터마크의 모습을 보여준다.

조건검출률
200토큰 분량 (단어 선택의 여지가 큰 산문)약 80%
400토큰 분량 (동일 조건)약 95%
단어의 10%를 유의어로 교체92% → 66%
단어의 25%를 유의어로 교체→ 17%
수학 등 선택의 제약이 큰 영역상당히 낮음

코드는 더 나쁘다. OpenAI가 그 이유를 솔직하게 밝혔다. 일반 산문에 비해 다음에 올 수 있는 선택지가 적어서, 신호를 숨길 여지가 작다는 것이다. 단어의 4분의 1만 바꿔도 17%까지 떨어지는 워터마크는 동기가 있는 상대에 대한 방어가 되지 못한다. 다른 모델에 한 번 통과시키고, 문장 몇 개를 바꿔 쓰고, 사람 편집자라면 어차피 손볼 단어를 손보면 신호는 사라진다.

이것은 OpenAI가 숨기는 결함이 아니다. 회사는 이 워터마크로 인간의 기여도를 측정할 수 없고, 소유권을 확립할 수 없고, 사용자를 특정할 수 없고, 글의 내용이 사실인지 검증할 수도 없으며, 워터마크가 없다는 것이 사람이 썼다는 증거도 아니라고 명시했다. 할 수 있는 일은 검출기 접근 권한을 가진 기관에게, 편집되지 않은 특정 문단이 아마도 OpenAI 모델에서 나왔을 것이라고 알려주는 것뿐이다.

검출기가 곧 정책이다

논쟁할 만한 결정은 검출기를 공개하지 않겠다는 선택이다. OpenAI가 내세운 이유는 오탐과 미탐이 실제로 존재하며 공개된 검출기는 오용을 부른다는 것이고, 이는 방어할 수 있는 주장이다. 오탐률 1%를 대학의 모든 학생 과제물에 적용하면, 억울하게 지목되는 학생의 수는 상당하다. 그래도 결과는 달라지지 않는다. 출처 확인은 공공의 역량이 아니라 기관의 역량이 된다. 교사도, 고용주도, 법원도, 독자도 확인할 수 없다. 심사를 통과한 연구기관만이, OpenAI가 신청을 받아들일 경우 확인할 수 있다.

현재 현장에 나와 있는 다른 두 구현과 비교해 보자. Anthropic은 2026년 8월에 텍스트 워터마크를 발표하고 모델 층위에서 적용했다. Claude의 모든 제품과 모든 경로에 걸쳐 작동하며 개발자용 opt-out은 없다. Google은 텍스트용 SynthID를 이미 내놨다. OpenAI의 구현은 셋 중 가장 조건부다. 법이 요구하는 곳에서는 의무, 요구하지 않는 곳에서는 선택, 그리고 읽어낼 수 있는 경로는 회사를 통할 때뿐이다.

이를 신중함으로 볼지 편의로 볼지는 어떤 유인을 보느냐에 달려 있다. 호의적으로 읽으면, 약한 신호를 대중의 손에 넘기면 이익보다 해가 크고, OpenAI는 이 기술이 정직하게 감당할 수 있는 범위에 배포를 맞춘 셈이다. 덜 호의적으로 읽으면, 기본값이 꺼진 선택형 워터마크와 비공개 검출기의 조합은 OpenAI의 최대 고객들 — API 위에 제품을 올리고, 자기 출력이 추적 가능해지는 것을 원하지 않는 쪽 — 에게 아무런 비용도 지우지 않으면서 브뤼셀을 만족시킨다. 출시된 결과물은 두 해석 모두와 들어맞는다.

그림을 바꿀 수 있는 유일한 약속은 OpenAI가 의향을 밝힌 textGrain의 오픈소스화다. 방법이 공개되면 원칙적으로 독립적인 검출이 가능해지고, 논점은 "확인할 권한이 있는가"에서 "확인이 애초에 작동하는가"로 옮겨간다. 공개된 수치로 보면, 두 번째 질문이 여전히 더 어려운 쪽이다.

Sources: OpenAI: Text provenance in the EU · The New Stack · Unite.AI · 9to5Mac

이어서 읽기