Table of Contents
모델 종합은 심층 학습의 핵심 측면이며, 모델이 비소 데이터에 어떻게 수행되는지 결정합니다. Proper 측정 및 개선 기술은 기계 학습 모델의 견고성과 정확성을 향상시킬 수 있습니다.
측정 모형 의약
모델의 일반화는 물론, 교육 중에 사용되지 않은 데이터에 대한 성능을 평가하는 데 필수적입니다. 일반적인 방법은 모델 성능의 비효율적인 견적을 제공하는 검증 및 테스트 데이터 세트를 사용하여 포함합니다.
정확도, 정밀도, 리콜, F1 점수와 같은 미터는 성능의 정량화에 사용됩니다. 또한, 다른 데이터 분할의 모델의 안정성을 이해하는 데 도움이 교차 유효성 같은 기술.
일반화 개선 기술
여러 전략은 모델의 능력을 일반화 할 수 있습니다. L2 정규화 및 드롭 아웃과 같은 정기화 방법은 학습 과정에 제약을 추가하여 과잉을 방지합니다.
Data augmentation은 모델을 더 강력한 기능을 돕는 교육 데이터의 다양성을 증가시킵니다. 유효성 데이터에 성능이 감소 될 때 조기 중단 할 수 있습니다. 과잉을 피하십시오.
가장 좋은 연습
교육, 검증 및 테스트 데이터셋 간의 명확한 분리를 유지하기 위해 중요합니다. 훈련 중에 정기적 인 모니터링 검증 성능은 hyperparameter tuning을 안내 할 수 있습니다. ensemble 메소드를 사용하여 여러 모델을 결합하여 일반화도 향상시킬 수 있습니다.
- 신뢰할 수있는 견적에 대한 크로스 유효성 사용
- 정기화 기법
- 데이터 augmentation 구현
- 초급 종료
- unseen data를 정기적으로 테스트