情報漏洩とは、組織や個人の機密情報や個人情報が外部へ不当に流出・開示される事象です。AI分野では、大規模言語モデルなどの生成AIに対して機密データや個人情報を入力した結果、訓練データとして取り込まれ第三者の出力に現れるリスクや、モデルから訓練データを復元する攻撃などが課題となっています。
情報漏洩とは
情報漏洩とは、外部に公開されるべきではない機密情報や個人情報が、管理不備やサイバー攻撃、不適切なAI利用などによって第三者に流出・閲覧されてしまう現象を指します。
詳しく解説
AI時代における情報漏洩は、従来のネットワーク侵害や従業員による誤送信に加え、AIモデルの利用プロセスに関連して発生する新たなリスクが存在します。企業がクラウド型の生成AIサービスに業務上の機密文書やプライベートな顧客データを入力した場合、そのデータがAIの再学習やサービス向上に利用され、他のユーザーの回答を通じて機密情報が出力されてしまう懸念があります。さらに、学習済みモデルのパラメータや出力結果を分析して元となった訓練データを逆割り出しするモデル反転攻撃などの手法も、情報漏洩の一種として警戒されています。適切なデータセキュリティ対策を行わなければ、企業の信頼低下や法的な賠償リスクに直結するため非常に重要な課題です。
具体例・使われ方
例えば、従業員がプログラミングのソースコードや未発表の決算資料を生成AIに入力し、それがモデルの学習に利用された結果、別の利用者の問い合わせ回答の中にそのコードの一部が含まれてしまうケースがあります。また、大規模言語モデルから個人の秘密情報を聞き出す不適切なプロンプトが実行され、意図せず個人情報が開示されるケースも該当します。
似た用語との違い
情報漏洩はデータが外部に流出する結果全体を指す広義の概念です。一方でデータ侵害は未承認のアカウントアクセスや不正侵入といった攻撃行動や違反プロセス自体を強調することが多く、情報漏洩はその結果として生じます。また、AI特有の脆弱性を突いてモデル内部からデータを抽出する攻撃手法であるモデル反転攻撃は、情報漏洩を引き起こす具体的な原因の一つという位置づけになります。
注意点
生成AIの利用において学習利用を拒否する設定を行っていれば完全に情報漏洩を防げるわけではなく、通信経路での盗聴や利用ログの漏洩リスクは残ります。そのため、入力前に機密情報をマスキングする前処理を入れるなど、多層的な対策が必要です。