Table of Contents
当机器学习模型对培训数据,包括噪音和异常点的学习得过好时,就会出现过度适应。 这降低了它向新数据概括的能力。 解决过度适应问题对于发展强健模型至关重要。 本文探讨了防止过度适应的实用策略和数学原理。
理解过度适应
当一个模型捕获到培训数据中的噪音而不是基本模式时,就会出现过度适应。这导致培训数据精度高,但无形数据上的表现不佳。识别出过度适应的迹象对于有效的模型调整至关重要。
防止因循守旧的实用战略
- 十字-变形:[ 使用k倍交叉验证等技术,在不同数据子集上评价模型性能.
- 规范化: 应用L1或L2规范化等惩罚来限制模型复杂度.
- 快速停止: 当验证数据上的表现开始下降时停止训练.
- 推算:[]通过删除不必要的参数或分支来简化模型.
- 数据增强:[] 增加培训数据可变性,提高通化性.
数学基础
规范化技术修改损失函数以惩罚复杂的模型。例如,L2规范化增加了一个与模型权重平方成比例的术语:
[文本{丢失}=文本{原始丢失}+羊肉酱 summ}\ w i^2]
用于控制正态强度。这鼓励减重,降低模型复杂度,防止过度调整。