AIセキュリティ自然言語処理ジェイルブレイクジェイルブレイクとは、大規模言語モデルなどの生成AIに対して安全対策や利用規約を迂回する特別な入力を行い、不適切な出力や本来禁止されている応答を引き出す攻撃手法や現象のことです。ロールプレイや巧みな前提条件の設定によって制限を解除させようとするもので、AIの安全性を脅かす課題としてセーフティフィルターの強化やアライメント対策が進められています。6 views · ♥ 0