Table of Contents
크로스 유효성 검사는 기계 학습 모델의 성능을 평가하기 위해 사용되는 통계 방법입니다. 그것은 잘 모델이 과잉의 위험을 감소시키기 위해 일반화하는 방법을 평가하는 데 도움이됩니다. 적절한 크로스 유효성 검사 기법을 구현하는 것은 신뢰할 수있는 강력한 모델 구축에 필수적입니다.
Cross-Validation은 무엇입니까?
Cross-validation은 여러 하위 설정으로 dataset을 분할하고, 이 하위 세트의 일부에 모델을 훈련하고 다른 사람에 테스트합니다. 이 과정은 단일 기차 테스트 분할과 비교된 모델의 성능의 더 정확한 견적을 제공합니다.
공통의 교차-발효 기술
- K-Fold Cross-Validation: 을 곱하여 k-1 부품에 대한 데이터와 나머지 부분에서 테스트하는 것과 동일하게 데이터를 곱합니다. 이 프로세스는 k 시간을 반복합니다.
- K-Fold:] K-Fold와 유사하지만, 각 접의 클래스 배포를 유지, imbalanced datasets에 유용합니다.
- Leave-One-Out Cross-Validation (LOOCV): 테스트에 대한 단일 데이터 포인트를 사용하며, 각 데이터 포인트에 반복됩니다.
Cross-Validation의 이점
크로스 유효성을 사용하여 모델 성능의 더 신뢰할 수있는 견적을 제공, 튜닝 하이퍼 파라미터에 도움, 과잉의 likelihood를 감소. 그것은 모델을 수행 할 수 있습니다 데이터의 다른 하위 세트.