Oossa

OpenAI、EUのChatGPTに任意の不可視ウォーターマークを導入

EUのユーザー向けChatGPT出力に隠し信号を埋め込む。API利用者は世界中で無効化できる。

OossaOossa公開日: 1 分で読める

Drew Beamer · Unsplash

OpenAIは、ChatGPTとCodexの出力に「textGrain」と呼ばれる不可視のウォーターマークを導入する。欧州連合(EU)のユーザーには有効化される。同社によると、生成テキストに機械可読な形でラベルを付けられるよう求めるEU AI法の要件に対応するため、今後数週間で機能を有効にする。OpenAIのAPIを使う開発者は、ウォーターマークを自由に有効・無効にできる。Claudeの出力すべてに世界中でウォーターマークを付けるAnthropicとは異なる方針だ。

ウォーターマークの仕組みと限界

textGrainは、モデルが単語を選ぶ際に統計的なパターンを加える。AnthropicのClaudeで使われているGoogleのSynthIDと同様の仕組みだ。OpenAIの社内テストでは、検出器は400トークン(約300語)の心理学関連の文章で約95%の確率でパターンを検出した一方、同じ長さの数学関連の文章では約60%にとどまった。文章の一部を少し変えるだけでも検出率は下がる。単語の10%を類義語に置き換えると検出率は約92%から66%に低下し、4分の1を置き換えると約17%まで落ちる。

検出器の利用

現時点でOpenAIは、申請手続きを通じて選ばれた研究者や専門機関にのみ検出器へのアクセスを認める。ツールが示すのはOpenAIのウォーターマークの有無だけで、誰が文章を書いたかや、使われたプロンプトは明らかにしない。

なぜ重要か

EUのユーザー向けChatGPT出力には規制当局が読み取れる隠しマーカーが付き、新たな表示ルールへの対応につながる。開発者はマーカーを付けない選択もできるため、第三者がAI生成テキストを見分けやすいかどうかに影響する可能性がある。文章を編集すると検出率が大きく下がるため、内容を少し言い換えるだけでウォーターマークを取り除ける可能性もある。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。