了解如何评价机器学习模型对于开发有效的算法至关重要。两个通用的度量法是准确性和精度。这些度量法有助于确定一个模型在特定数据集上的运行情况。

什么是模型精确度?

精确度测量模型在所有预测中所作的正确预测的比例,其计算方法是将正确预测的数量除以预测的总数.

准确性的公式是:

准确性=(正确预测数)/(总预测数)]

当数据集有平衡类时,准确性是有用的,但如果分类不平衡,则可能误导.

什么是模型精度?

精确度测量模型所做的所有正预测中真实正预测的比例,它表明预测正预测病例中有多少是实际正数.

精确度的公式是:

精度=(真正数)/(真正数+假正数)]

高精度意味着当模型预测为正时,通常是正确的,在假阳性成本高昂的情景中尤为重要.

如何计算这些计量

要计算准确性和精确性,需要一个混淆矩阵,将预测结果归纳为四个类别:真阳性,真阴性,假阳性,假阴性.

一旦你得到这些值,就把它们插入公式中来计算度量衡。许多机器学习库,如scikit-learn,提供了直接计算准确性和精确性的函数。

  • 迷惑矩阵
  • 真实阳性(TP)
  • 假阳性( FP)
  • 真阴性( TN)
  • 假负数( FN)