何が起きたか
OpenAIが10月5日付で、EUのAI法への対応として、文章の「透かし」の方針を発表した。ChatGPTやCodexが出す文章に、目に見えない印を入れる話だ。
発表の要点は3つ。
- ChatGPTとCodex: 今後数週間かけて、対象になる文章の出力に透かしを入れる。範囲はEUの全プランのみ。発表は「開始時点で世界共通の既定にはしない」と書いている
- API: 同じ日から世界中の利用者が、一部のモデルで透かしを自分でオンにできる。既定はオフ
- 検出ツール: 申請を受け付けるが、最初は承認された研究者と専門組織だけ。誤検出と見落としがありうるので、開始時点では一般に公開しない
発表に日本の記載はない。書かれているのは上の範囲までだ。
生活で何が変わるか
気になるのは「ChatGPTで書いた文章に印が入るのか」だと思う。発表を読む限り、入ると書かれているのはEUのChatGPTとCodexで、日本は範囲として挙がっていない。Claudeは開始時点で全世界に適用されると既報に書いたので、そこが違う。ただしClaudeも、文章を調べる手段は一部の組織に限られている。
透かしがあっても、分かることは限られる。発表は次のように書いている。
- 透かしは利用者を特定しない。人・組織・アカウント・プロンプト・会話とは結びつかない
- 人がどれだけ書いたかも、正しい内容かも分からない
- 検出されなくても、人が書いた証明にはならない。短い・編集した・翻訳した文章は検出しにくい
数字も出ている。400トークンの文章で語の10%を類義語に置き換えると、検出は約92%から66%に下がり、25%を置き換えると17%になる。検出率は、心理学のような内容で、200トークンの文章が約80%、400トークンが約95%(誤検出率1%の設定)。数学のように言い方の幅が小さい内容は、さらに低いと書かれている。
画像と音声は別で、対応するファイルならopenai.com/verifyで誰でも確認できる。
日本語のヘルプも見た。英語版は10月6日1時32分(日本時間)の取得時点で「Updated: 1 hour ago」の表示で、文章の透かしはEUのみと書いている。日本語版も同じ時刻・同じ表示なのに、テキストへの対応は「目指しています」という記述で、EUでの開始は書かれていなかった。
マスターの一言
自分は検出ツールを試していないし、手元のChatGPTの文章に透かしが入っているかも確かめていない。分かるのは発表とヘルプに書かれている範囲までだ。日本の利用者に何が起きるかは書かれていないので、発表かヘルプの更新を見て確かめるつもりだ。
