バイアス
バイアスとは、AIや機械学習において予測値と正解値の間に生じる系統的なずれ、またはデータの偏りによって生じる予測の不公平性のことです。統計学的にはモデルの表現力不足による誤差を指し、AI倫理では人間社会の偏見を反映した差別的な判定を指します。公平なAIを構築するには、学習データの選定から評価まで各段階でバイアスを監視・排除する対策が重要です。
AI倫理に関するAI用語を6件掲載しています。意味や使い方、関連用語を一覧から確認できます。
バイアスとは、AIや機械学習において予測値と正解値の間に生じる系統的なずれ、またはデータの偏りによって生じる予測の不公平性のことです。統計学的にはモデルの表現力不足による誤差を指し、AI倫理では人間社会の偏見を反映した差別的な判定を指します。公平なAIを構築するには、学習データの選定から評価まで各段階でバイアスを監視・排除する対策が重要です。
セーフティフィルターとは、生成AIにおいて有害や不適切なコンテンツの入力・出力を検知し、自動的に遮断・修正する安全制御機構です。差別的発言、犯罪の助長、個人情報漏洩などのリスクを防ぐためのガードレールとして機能し、ユーザーからの入力プロンプトとAIの出力データの双方をリアルタイムで監視してシステムの安全性を担保します。
AIアライメントとは、人工知能の目的や行動を人間の意図、価値観、および倫理的な基準に一致させる技術やプロセスのことです。大型言語モデルなどのAIが誤った情報や有害なコンテンツを出力しないように制御し、人間の安全と利益に沿って安全に機能させるために重要なAI倫理の研究分野となっています。
スーパーインテリジェンスとは、科学的創造性や全般的な知恵、社会的スキルなど、ほぼ全ての分野において最も優れた人間の知性を遥かに凌駕する仮想上の人工知能です。汎用人工知能の先の段階として議論されており、技術的特異点(シンギュラリティ)との関連や、安全に制御するための技術倫理的な研究が世界中で進められています。
AIにおける公平性とは、アルゴリズムや機械学習モデルが特定の属性(性別、人種、年齢など)に基づいて不当な偏見や差別的な予測・判断を行わない状態を指します。学習データに含まれるバイアスを削減し、すべてのユーザーや対象者に対して均等かつ適切な利益や機会の分配を行うことが求められます。
AI安全性(AI Safety)とは、人工知能システムが人類の利益に合致し、予期せぬ危害や破滅的なリスクをもたらさないように設計・運用するための研究・実践分野です。システムの行動を人間の意図に沿わせるアライメント技術や、高度なAIが暴走するリスクへの対策などを含み、技術の健全な発展に不可欠な概念となっています。