Table of Contents
交叉验证是一种用于评估机器学习模型性能的统计方法,有助于评估模型对无形数据的概括程度。 适当的设计和计算对于获得可靠结果和避免过于适应或不足至关重要。
交叉确认的基本原则
交叉验证涉及将数据分割成子集,将模型训练在一些子集上,并在其他子集上进行测试。这一过程提供了模型在新数据上的性能估计。最常见的方法是k倍交叉验证,数据被分割为k等元部分。
设计考虑
选择正确的参数至关重要。 折叠( k) 影响偏差和偏差的数量。 更高的 k 会减少偏差但增加计算时间。 通常情况下, k 会被设定为 5 或 10 , 用于平衡结果。 确保数据在分拆前随机洗牌, 防止因数据顺序而出现偏差 。
可靠结果计算
计算所有折叠的平均性能衡量标准提供了总体估计。此外,计算标准偏差可以洞察模型性能的可变性。这有助于理解模型的稳定性。
- 将数据除以 k 等元部分
- K-1部分的列车,其余部分的试验
- 对所有 k 部件重复
- 计算业绩计量的平均值和标准差