Table of Contents
이 나무는 분류 및 회귀 작업에 사용되는 인기있는 기계 학습 방법입니다. 그들은 기능 값에 따라 데이터를 분할하여 작업을 수행하고, 해석하기 쉬운 예측을 만드는 나무 같은 구조를 만듭니다. 그러나 이러한 나무가 결정이 어려울 수 있는지 이해하는 것은 복잡하고 복잡한 데이터 세트와 특히 어려울 수 있습니다. 의사 결정 경계는 모델의 행동을 결정하고 해석성을 향상시킵니다.
결정 경계는 무엇입니까?
Decision 경계는 기능 공간에 다른 클래스를 분리하는 라인 또는 표면입니다. 그들은 모델을 다른 한 클래스를 예측하는 지역을 정의합니다. 이러한 경계를 시각화하는 것은 우리가 모델 파티션 데이터를 어떻게 볼 수 있으며 과잉 또는 하향과 같은 잠재적 인 문제를 밝혀줍니다.
비주얼화(Valizing) 배운
의사 결정 경계를 효과적으로 분석하기 위해, 그것은 도형을 사용하여 두 개 또는 세 가지 차원에서 시각화하는 것이 일반적입니다. 이 시각화는 결정 트리가 기능 공간을 분할하는 방법을 보여줍니다. 기술에는 다음과 같습니다.
- 결정 영역과 함께 데이터 포인트를 뽑기
- 연속 기능에 대한 연속적인 도형을 사용하여
- 차원 높은 치수 데이터에 대한 PCA와 같은 치수 감소 방법 적용
분석 도구 및 기술
몇몇 공구는 결정 경계의 시각화를 촉진합니다:
- Scikit-learn의 플로팅 기능
- Matplotlib 및 사용자 정의 시각화를위한 Seaborn
- Plotly와 같은 상호 작용하는 도구 동적 탐험
연습 단계
연습의 결정 경계를 분석하려면 다음 단계를 따르십시오.
- dataset에 대한 결정적인 트리 모델을 기차로
- 시각화를 위해 필요한 경우 두 가지 기능으로 데이터를 줄입니다.
- 기능 공간을 다루는 메쉬 그리드 생성
- 그리드의 전적 클래스 라벨
- 실제 데이터 포인트와 함께 그리드 예측을 끄십시오.
분석 Decision 경계의 이점
이해 결정 경계는 몇몇 이점을 제안합니다:
- 모델이 과잉되거나 부패 될 수있는 지역을 식별
- 기능에 대한 통찰력 제공
- Model 개선에 대한 관련 기능 선택에 대한 도움말
- 모델 행동의 더 나은 의사 소통을 할 수 있습니다.
관련 기사
이 웹 사이트는 귀하가 웹 사이트를 탐색하는 동안 귀하의 경험을 향상시키기 위해 쿠키를 사용합니다. 이 쿠키들 중에서 필요에 따라 분류 된 쿠키는 웹 사이트의 기본적인 기능을 수행하는 데 필수적이므로 브라우저에 저장됩니다. 또한이 웹 사이트의 사용 방식을 분석하고 이해하는 데 도움이되는 제 3 자 쿠키를 사용합니다. 이 쿠키는 귀하의 동의하에 만 브라우저에 저장됩니다. 이러한 쿠키를 거부 할 수도 있습니다. 이러한 쿠키 중 일부를 선택 해제하면 검색 환경에 영향을 미칠 수 있습니다.