機械学習評価指標

混同行列

こんどうぎょうれつ · Confusion Matrix
2 views

混同行列とは、機械学習の分類モデルが予測した結果と実際の正解データを比較し、パフォーマンスを視覚的かつ定量的に評価するための表です。予測結果を真陽性や偽陽性などのカテゴリに分類して集計することで、モデル全体の精度だけでなく、どのクラスをどのように間違えたかという詳細な傾向を分析できます。

混同行列とは

混同行列とは、機械学習における分類モデルの予測結果と実際の正解ラベルを格子状の表にまとめ、モデルの予測精度や誤りの傾向を詳細に可視化・分析するための評価手法です。

詳しく解説

混同行列は、正解データとモデルの予測結果の組み合わせを列と行に整理して集計した表です。主に二クラス分類などで用いられ、正解と予測の対比から「真陽性」「真陰性」「偽陽性」「偽陰性」の4つの要素に分類されます。単に全体の中でどれくらい当たったかを示す精度という指標だけでは、データの偏り(クラス不均衡)が存在する場合にモデルの正しい性能を見誤る危険性があります。混同行列を活用することで、特定のクラスに対する過剰な予測や見落としの傾向を明確にし、適合率再現率といった詳細な評価指標を算出するための基礎データを提供します。

具体例・使われ方

例えば、スパムメールの自動検出システムや医療画像による病気診断モデルの評価で使用されます。医療診断において、実際に病気である人を正しく病気と判定した割合である真陽性の数を把握すると同時に、健康な人を誤って病気と判定してしまった偽陽性の数も確認できます。このように、見落とし(偽陰性)と誤検知(偽陽性)のどちらが多く発生しているかを直感的に把握できます。

似た用語との違い

単一の数値で表される評価指標との違いとして、混同行列はモデルの評価結果全体を行列形式のデータとして保持する点があげられます。たとえば、精度適合率再現率F1値といった指標は、混同行列の数値を基に計算された単一の評価尺度です。混同行列自体は単一の数値指標ではなく、すべての予測と正解の組み合わせを網羅した包括的な評価ツールです。

注意点

データセットに極端なクラス不均衡がある場合、混同行列の各要素の数値だけをそのまま比較すると誤解が生じることがあります。また、多クラス分類においてクラス数が非常に多い場合は行列が巨大化し、視覚的な傾向の把握が難しくなるため、正規化して割合で表示するなどの工夫が必要です。

更新日時: 2026年9月1日 19:41