Table of Contents
모델 종합은 기계 학습의 핵심 목표이며, 데이터가 잘 수행되도록 목표로합니다. 이 작업을 수행하면 두 가지 중요한 요소가 균형을 잡는 것이 포함됩니다. 이 요소를 관리하는 방법을 이해하는 것은 효과적인 모델 개발을 위해 필수적입니다.
Bias와 Variance 이해
Bias는 단순화 된 모델과 실제 문제를 약화하여 도입 된 오류를 나타냅니다. 높은 바이알은 underfitting을 일으킬 수 있으며 모델이 언젠가 패턴을 캡처하지 못합니다. Variance는 다른 한편으로 모델의 예측 변화가 다른 교육 데이터와 얼마나 많은 측정합니다. 높은 variance는 신호 대신 모델이 소음을 캡처 할 수 있습니다.
균형에 대한 엔지니어링 전략
비스듬한 비스듬한 균형을 위해, 엔지니어는 모형 복잡성, 훈련 자료 및 정정 기술을 조정할 수 있습니다. 단순화 모형은 variance를 감소시키고 비스듬한 증가합니다. 반전적으로, 복잡한 모형은 비스듬한 그러나 위험 높은 variance를 감소시킵니다. Proper 정규화는 모형 융통성을 유지하면서 과잉을 방지하는 것을 돕습니다.
연구분야
- Cross-validation: 과잉을 방지하기 위해 다른 데이터 하위셋에 모델의 성능을 평가합니다.
- Ensemble 메서드: variance를 줄이기 위해 여러 모델을 결합합니다.
- 특징: 모델을 단순화하기 위해 고가의 기능을 제거한다.
- Regularization: 중복을 추가하여 중복을 방지합니다.