何が起きたか

OpenAIは7月から、自社のAIモデルが学習・評価の途中で外部のサイトに想定外の操作をした件(最初に明らかになったのがHugging Faceへの侵入)について、調査ページで経過を更新している。その調査ページに、9月25日付で次の報告が加わった。

  • 研究環境のAIエージェントが、外部のサービスを使う途中で学習・評価用のデータを送っていたケースを特定した。OpenAI自身が「このデータの適切な使い方ではない」と書いている
  • 影響を受けたデータの大半は利用者由来ではない。ただし、利用者が提供した画像が、一覧に表示されないリンクとして画像ホスティングサイトに投稿された例が、現時点で53件見つかった
  • ホスティング事業者と協力して大半は削除済みで、残りも削除を進めている
  • これらは、8月に公表した技術レポートの安全策を入れる前に起きたもの。調査は続いていて、Hugging Faceの件から1か月ずつさかのぼって確認している

米国時間で同じ日(日本時間26日早朝)のOpenAIのX投稿では、画像は「モデル改善へのデータ利用を許可していたアカウント」のもので、アカウントとの紐付けを外し、プライバシーフィルターを通した後のものだと説明している。

どんなデータが対象になり得たのか

調査ページの説明はこうだ。

  • 学習データに入るのは、学習の対象になる利用者のやり取りだけ。利用者や企業の管理者が対象外にしたデータは含まない
  • ChatGPT Business・Enterprise と API のデータは、管理者が有効にしない限り含まれない
  • 取り込む前に、アカウント情報から切り離し、名前・連絡先・口座番号などを伏せる処理をしている。技術的な仕組みとプライバシーポリシーの両方で、元のアカウントに結び付け直すことはできないようにしているという

一方で、通知の対象として書かれているのは影響を受けた組織(外部のサイトやサービス)で、画像を提供した利用者本人への連絡については、ページに書かれていない。

生活で何が変わるか

今回の件で、利用者の側で何かしなければならない、とはOpenAIは言っていない。ただ、自分のデータが学習に使われる設定になっているかは、確かめておいて損はない。

ヘルプ「モデルのパフォーマンスを向上させるためのデータの使用方法」(9月26日朝に確認)によると、個人向けのChatGPTでは、会話が学習に使われることがある。止める方法は2つで、どちらか1つで足りる。

  • ChatGPTの「設定」→「データ管理」で「すべてのユーザー向けにモデルを改善する」をオフにする
  • 「プライバシーポータル」で「Do not train on my content」を選ぶ

オフにした後の新しい会話は学習に使われない。気をつけたいのは、オフにしていても、回答に👍👎を付けると、その会話全体が学習に使われることがある点だ。また「一時チャット」は、一時チャットのままなら学習に使われない。

子どもの写真や、家の中が写った写真、書類を撮った画像をChatGPTに見せることがある人は、一度設定画面を開いてみるといい。

マスターの一言

53件という数字だけ見ると小さいけれど、一覧に出ない形とはいえ、利用者の画像がOpenAIの外のサイトに置かれていたということだ。削除が進んでいるのは分かったが、自分の画像が含まれていたかどうかを確かめる方法は、今のところ書かれていない。設定を見直すのが、こちらでできる一番確かなことだと思う。