再現率とは
Recall
実際に陽性である事例のうち、モデルが正しく検出できた割合を示す評価指標
ひとことで言うと
本当に正解であるものの中で、AIが見逃さず答えられた割合を示す指標。
概要
再現率(Recall)とは、実際に「陽性(該当する)」である事例のうち、モデルが正しく陽性として検出できた事例の割合を示す評価指標。 見逃し(偽陰性)をどれだけ抑えられているかを表す指標であり、病気の診断のように、見逃しのコストが大きいタスクで重視される。 適合率(Precision)とはトレードオフの関係になることが多く、両者をバランスよく評価するためF1スコアと組み合わせて使われることも多い。 RAGにおける検索(Retrieval)の評価でも、必要な文書をどれだけ取りこぼさず検索できたかを示す指標として用いられる。 適合率を犠牲にしてでも取りこぼしを避けたい場面(重大な副作用のある薬剤の検出等)では、再現率が重視される評価軸として選ばれる。
背景
分類モデルの性能を、単純な正解率(Accuracy)だけで評価すると、陽性の事例が少ない不均衡なデータセットでは実態を正しく反映しない場合がある。 再現率は、モデルが本来検出すべき陽性事例をどれだけ取りこぼしていないかを測る指標として、こうした場面でも有効な評価軸を提供するために整理された。
アーキテクチャ
再現率は、TP(True Positive, 正しく陽性と判定した数)を、TP+FN(False Negative, 誤って陰性と判定した数)で割った値として計算される(Recall = TP / (TP + FN))。
利点
- モデルが本来検出すべき陽性事例を、どれだけ取りこぼさず検出できているかを直接示せる
- 見逃しのコストが大きいタスクで、モデルの実用上の適性を評価しやすい
欠点
- 再現率だけを高めようとすると、陽性と判定する基準を緩めすぎて誤検知(偽陽性)が増えやすい
- 適合率と合わせて見なければ、モデル全体の性能を正しく評価できない
比較
関連用語
よくある質問
参考文献
- Documentationscikit-learn: Precision, recall and F-measures