Table of Contents
올바른 감독 학습 알고리즘을 선택하고 매개 변수를 조정하는 것은 효과적인 기계 학습 모델에 필수적인 단계입니다. Proper 선택은 정확도를 향상시키고, 과잉을 줄이고, 계산 리소스를 최적화 할 수 있습니다. 이 문서는 실제 응용 분야에서 알고리즘 및 튜닝 매개 변수를 선택하기위한 실용적인 고려 사항을 논의합니다.
Algorithm 선택
다른 감독 학습 알고리즘은 다양한 유형의 데이터와 문제 복잡성을 위해 적합합니다. 요인은 선택에 따라 데이터 크기, 기능 유형 및 모델의 원하는 해석성을 포함합니다. 일반적인 알고리즘에는 결정 나무, 지원 벡터 기계 및 신경 네트워크가 포함됩니다.
크로스 유효성을 사용하여 여러 알고리즘을 평가하는 것이 좋습니다. 특정 데이터 세트에서 가장 잘 수행되는 것을 결정하십시오. 비교 효율성과 알고리즘을 선택할 때 noisy 데이터를 처리 할 수있는 능력을 고려하십시오.
모수 조정
매개변수 조정은 모델 성능을 최적화하기 위해 하이퍼 파라미터를 조정합니다. 그리드 검색 및 임의 검색 시스템과 같은 기술은 다른 매개 변수 조합을 탐구합니다. Bayesian 최적화와 같은 자동화 된 방법도 효과적 일 수 있습니다.
키 하이퍼 파라미터는 알고리즘에 따라 다릅니다. 예를 들어, 지원 벡터 기계에서 커널 타입과 정규화 매개 변수를 조정하는 것은 중요합니다. 결정 나무에서 깊이 조정 및 잎 당 최소 샘플은 과잉을 방지 할 수 있습니다.
연습 팁
- 기본 파라미터로 시작하고 기본 성능 평가.
- 모델 안정성을 평가하는 크로스 유효성을 사용합니다.
- 과도한 계산을 피하기 위해 검색 공간을 제한합니다.
- 훈련 및 검증 결과에 따라 overfitting를 위한 감시자.
- 문서 매개 변수 선택 및 재현성에 대한 결과.