Table of Contents
기계 학습 모델의 예상된 일반화 오류가 눈에 띄는 데이터에 성능 평가에 필수적입니다. 그것은 모델이 새로운 데이터 포인트를 예측하고 최고의 모델 구성을 선택하는 데 도움이되는 방법을 측정합니다.
일반화 오류는 무엇입니까?
일반화 오류는 교육 데이터의 오류와 새로운 오류, 비소 데이터에 대한 오류의 차이입니다. 그것은 데이터가 훈련 된 데이터를 넘어 모델이 일반화하는 방법을 나타냅니다.
예상된 일반화 오류를 계산하는 방법
여러 가지 방법들은 크로스 유효성, 부츠 스트랩, 이론 경계를 포함한 예상된 일반화 오류를 추정해야 합니다. 각 접근법에는 데이터 세트 및 모델 복잡성에 따라 장점과 제한이 있습니다.
Cross-Validation 사용
Cross-validation은 여러 하위 설정으로 데이터를 분할하고, 다른 사람의 모델들을 훈련합니다. 모든 테스트의 평균 오류는 모델의 일반화 오류의 추정을 제공합니다.
이론적인 경계와 자극
VC 이론이나 Rademacher 복잡성에서 파생된 것과 같은 이론적 경계는 모델의 용량과 교육 데이터의 크기에 따라 견적을 제공합니다. 이러한 경계는 기대를 안내 할 수 있지만 보존 할 수 있습니다.
- 크로스 유효성
- 관련 상품
- 이론 경계
- 홀딩 방법