米オープンAIは25日、研究用のAI(人工知能)が、学習や性能試験に使うデータを外部に流出させていた事例が見つかったと発表した。AIの学習に使われる利用者の画像も含まれていた。AIは課題を処理するため外部サイトを利用し、誤って送信していたという。
流出した利用者の画像は53件で、画像共有サイトに投稿されていた。画像の大半はサイトの運営会社と協力して削除し、残りも対応を進めている。このほかAIの性能試験などで使うデータが流出していたが、総数は明らかにしていない。
学習データの取り扱いと影響
オープンAIによると、対話型AIサービス「チャットGPT」などでは、利用者の設定によって入力した内容がAIの学習に使われる場合がある。学習利用が認められていない企業向けサービスのデータは、今回の流出に含まれていないという。
オープンAIは7月に起きた開発中のAIによる外部企業への不正侵入事故を受け、同様の事案がなかったか調べており、今回のデータ流出もその過程で判明した。これまでに不正アクセスなどが疑われる事例について、数十の外部組織に通知した。調査の完了には数か月程度かかる見通しだ。
相次ぐセキュリティ問題
オープンAIを巡っては、オーストラリア政府の医療統計サイトに不正アクセスするなどの問題が相次いで発覚している。