人工知能
OpenAIがテキスト透かしを投入。自動適用はEUだけ、検出器は承認された一部にしか渡らない
OpenAIの透かし技術textGrainは、10月5日からEUのChatGPTとCodexで自動適用され、それ以外の地域ではオプトインにとどまった。公開された検出率が示すのは、読まれる分には耐えるが編集には耐えない信号である。しかも検出器は申請制だ。
MAI
OpenAIは10月5日、テキスト出力への透かし付与を開始した。そして、この機能の投入のしかたは、機能そのものよりも多くを語っている。透かしは欧州連合(EU)のChatGPTとCodexの利用者には自動で適用され、API利用者に対しては世界中どこでも任意かつ既定では無効、そして透かしを読み取る検出器は承認リストの外にいる誰の手にも渡らない。技術の名称はtextGrainで、OpenAIは発表と同時にその検出率も公開した。この数値こそが発表のなかで最も有用な部分である。透かしが実際に何を達成しているのかを、そのまま示しているからだ。
何が、どこに適用されるのか
textGrainは、OpenAIの説明によれば「モデルの語選択に目に見えない統計的な信号」を埋め込む。文中に同程度に適合する語が複数あるとき、検出器が後から認識できるパターンに沿って、モデルがそのうちの一語へと誘導される。目に見える出力は何も変わらず、OpenAIはテストで有意な品質低下は見られなかったとしている。
| 対象 | 10月5日時点の状況 |
|---|---|
| ChatGPTとCodex(EU) | 自動適用、「今後数週間かけて」展開 |
| ChatGPTとCodex(EU以外) | 透かしなし |
| API(対象モデル、全世界) | オプトイン、既定では無効 |
| 検出器 | 申請制。承認された研究者と専門機関に、個別審査で付与 |
EUだけが自動適用という線引きは、製品上の判断ではない。EU AI法(EU AI Act)第50条は、生成系システムの提供者に対し、合成された出力を機械可読な形で標示することを求めており、この義務は2026年8月2日に発効した。OpenAIは、その義務を課した法域で法的要件を満たし、それ以外の利用者基盤には手を付けていない。
数字こそが本題である
OpenAI自身が公開した数値は、誤検出率1%の条件下で測られたもので、読まれる分には耐えるが編集には耐えない透かしの姿を示している。
| 条件 | 検出率 |
|---|---|
| 200トークンの文章(語選択の自由度が高い散文) | 約80% |
| 400トークンの文章(同) | 約95% |
| 語の10%を同義語に置換 | 92% → 66% |
| 語の25%を同義語に置換 | → 17% |
| 数学など選択の制約が強い領域 | 大幅に低下 |
コードはさらに厳しい。OpenAI自身がその理由を率直に述べている。通常の散文に比べ、次に来る語としてあり得る選択肢が少なく、信号を隠す余地が小さいのだ。4分の1の語を置き換えただけで17%まで落ちる透かしは、動機のある相手に対する防御にはならない。別のモデルに通し、いくつかの文を言い換え、人間の編集者ならどうせ直すような語を直せば、信号は消える。
これはOpenAIが隠している欠点ではない。同社は、この透かしでは人間の寄与の度合いを測れず、所有権を確立できず、利用者を特定できず、文章の内容が真実かどうかも検証できない、そして透かしがないことは人間が書いた証明にはならないと明言している。できるのは、検出器へのアクセスを持つ機関に対して、未編集の特定の文章がおそらくOpenAIのモデルから出たものだと伝えることだけだ。
検出器こそが政策である
議論に値する決定は、検出器を公開しないという選択である。OpenAIの説明する理由は、誤検出も検出漏れも現実に存在し、公開された検出器は悪用を招くというもので、これは擁護できる主張だ。誤検出率1%を大学のすべての学生のレポートに適用すれば、無実のまま告発される学生の数は相当なものになる。それでも帰結は変わらない。出自の確認は、公共の能力ではなく機関の能力になる。教師も、雇用主も、裁判所も、読者も確かめられない。審査を通った研究機関だけが、OpenAIが申請を認めれば確かめられる。
現時点で実装されている他の二例と比べてみる。Anthropicは2026年8月にテキスト透かしを発表し、モデル層で適用した。Claudeのあらゆる製品・あらゆる経路に及び、開発者向けのオプトアウトはない。Googleはテキスト向けのSynthIDを投入済みだ。OpenAIの実装は三者のなかで最も条件付きである。法が求めるところでは必須、求めないところでは任意、そして読み取れるのは同社を通してのみ。
それを慎重さと見るか都合と見るかは、どの誘因に注目するかで変わる。好意的に読めば、弱い信号を一般の手に渡せば益より害が大きく、OpenAIはこの技術が誠実に担える範囲に展開を合わせたということになる。好意的でない読み方をすれば、既定で無効のオプトイン透かしと非公開の検出器という組み合わせは、OpenAIの最大の顧客——APIの上に製品を築き、自社の出力を追跡可能にはしたくない層——に何の負担も課さないまま、ブリュッセルを満足させる。出荷されたものは、どちらの読み方とも整合する。
状況を変えうる唯一の約束は、OpenAIが意向を示しているtextGrainのオープンソース化である。手法が公開されれば、原理的には独立した検出が可能になり、議論は「確かめることを許されているか」から「確かめることがそもそも機能するのか」へ移る。公開された数値を見るかぎり、後者のほうがなお難しい問いである。
Sources: OpenAI: Text provenance in the EU · The New Stack · Unite.AI · 9to5Mac