Principal Component Analysis (PCA)는 데이터의 치수를 줄이기위한 널리 사용되는 기술입니다. 그러나 PCA의 효과에 영향을 미칠 수있는 일반적인 pitfalls가 있습니다. 이러한 문제를 인식하고 적절한 전략을 적용 할 수 있습니다 분석 결과를 설명합니다.

PCA의 일반적인 Pitfalls

PCA는 일반적으로 사용되는 데이터의 정상적인 실수입니다. PCA는 기능의 다양한에 민감하므로 큰 스케일을 가진 변수는 주요 구성 요소를 지배 할 수 있습니다. 또 다른 문제는 고유의 식별을 검증하지 않고 구성 요소를 과소화합니다. 또한 PCA를 비선형 데이터에 사용하여 PCA를 사용하여 선형 관계를 가정하면서 결과를 이끌어 낼 수 있습니다.

Mitigate Pitfalls에 전략

PCA를 적용하기 전에 사기 문제, 표준화 또는 정상화 데이터를 해결하려면. 이 기능은 분석과 동일하게 기여합니다. 구성 요소의 중요성을 결정하려면, 설명 된 다양한 비율 또는 scree 플로트와 같은 기술을 사용하십시오. 비선형 데이터를 위해 Kernel PCA 또는 t-SNE와 같은 대안 방법을 고려하십시오.

추가 팁

  • 결과가 발생할 수 있는 아웃리더를 확인 합니다.
  • 과잉 증식 방지를 위해 주의깊게 주된 성분.
  • PCA를 더 나은 통찰력을 위해 도메인 지식과 결합하십시오.
  • 다른 datasets 또는 방법으로 결과를 검증합니다.