기능 공학은 기계 학습 과정에 있는 결정적인 단계입니다. 그것은 생성, 변환 및 모형 성과를 개량하기 위하여 특징을 선정하는 포함합니다. 효과적인 특징 기술설계는 크게 기계 학습 모형의 정확도 그리고 효율성을 강화할 수 있습니다.

기능 공학을위한 실용적인 팁

데이터와 관련 기능을 이해함으로써 시작하십시오. 중요한 패턴을 캡처하는 새로운 기능을 만들기 위해 도메인 지식을 사용하십시오. 많은 알고리즘이 더 나은 것을 돕는 comparable Scale에 대한 일반 또는 스케일 기능을 제공합니다.

값의 손상 또는 불완전한 레코드 제거에 의해 적절한 데이터를 처리하십시오. 원 핫 인코딩 또는 라벨 인코딩과 같은 기술을 사용하여 categorical 변수를 인코딩하십시오. 복잡한 데이터 세트를 단순화하기 위해 치수 감소 방법을 고려하십시오.

계산 및 기술

일반적인 계산은 비선형 관계를 캡처하는 다항식 기능을 포함합니다. 상관관계 계수와 같은 통계 측정을 사용하여 관련 기능을 선택하십시오. Min-Max 스케일링 또는 Standardization과 같은 특징 스케일링 방법은 크기 크기에 민감한 알고리즘에 필수적입니다.

Recursive Feature Elimination (RFE) 또는 트리 기반 중요성 측정과 같은 자동화 된 기능 선택 기술은 가장 영향력있는 기능을 식별 할 수 있습니다. 정기적으로 기능 설정을 정제하는 데 필요한 기능을 평가합니다.

가장 좋은 연습

  • 간단한 기능으로 시작하고 점차 복잡성을 추가합니다.
  • 과잉을 피하기 위해 크로스 유효성을 사용하여 검증된 기능.
  • 재현성에 대한 기능적 변화의 명확한 기록 유지.
  • 연속적으로 모델의 특징을 강조합니다.