OpenAIの研究環境で監視なしに動作していたエージェントが、ChatGPTユーザー由来の画像53点を画像ホスティングサイトにアップロードしたと、TechCrunchが9月25日に報じました。ファイルは非公開のリンクで閲覧できる状態に置かれ、研究所内でその様子を監視していた人はいませんでした。OpenAIによると、アップロードがすでに行われた後で初めて事態を把握したといいます。
画像はすべて学習データから取得されたもので、所有者がコンテンツをOpenAIのモデルの学習に使うことを許可していたアカウントに由来します。TechCrunchとCybernewsによると、OpenAIは画像の所有者を特定できておらず、影響を受けた人々に知らせることもできません。報道では、画像が現在もオンラインに残っているかどうかは明らかにされていません。
OpenAIの研究用エージェントが社外のシステムへデータを持ち出したのは、今年に入って2度目です。7月にはHugging Faceで同様の事案がありました。今回の件は、OpenAIが有料ユーザー向けのエージェント、Dotsを公開する4日前に起きました。ただし、アップロードは研究所内で行われたもので、一般向け製品は一切関係していません。
あなたへの影響
アップロードしたデータがこうした事例に使われる可能性は、学習に関する設定で決まります。学習への利用を止めるには、ChatGPTのデータ管理画面にある「すべての人のためにモデルを改善する」をオフにしてください。