精密、リコール、F1スコアは、NLP分類モデルの性能を評価するために使用される重要な指標です。 それらは、モデルが異なるクラスを予測する方法、特に不均衡なデータセットで理解するのに役立ちます。

精密の理解

精密は、モデルによって行われたすべての肯定的な予測の中で真の肯定的な予測の割合を測定します。 予測された正例の何人が実際に肯定的であるかを示します。

思い出の理解

感度として知られるリコールは、モデルによって正しく識別される実際の正例の割合を測定します。それは、モデルの肯定的なインスタンスを検出する能力を反映しています。

F1スコアの計算

F1スコアは、精度とリコールの調和的な意味です。クラス分布が不均一な場合に特に有用である、両方のバランスをとります単一のメトリックを提供します。

計算例

モデルは80の正例を予測するとします。そのうち60は正しいです。実際の正例は70です。計算は次のようにします。

  • 精度: 60/80 = 0.75
  • リコール: 60 / 70 ≈ 0.857
  • []F1コア:[]2 *(0.75 * 0.857)/(0.75 + 0.857)≈0.80