Confidence 간격은 표본 자료에 근거를 둔 무슨 진정한 가치가 낙하될 가능성이 있는 범위 견적하기 위하여 이용된 통계 공구입니다. 기계 학습에서는, 그들은 모형의 산출의 신뢰성을 평가하는 것을 돕는 예측의 주위에 불확실한 측정을 제공합니다.

분쟁 해결은 무엇입니까?

자신감을 갖는 간격은 자신감을 수준으로 알려진 지정된 확률로 진정한 매개 변수 값을 포함 할 가능성이있는 데이터에서 계산됩니다. 일반적인 신뢰 수준은 90 %, 95 % 및 99 %입니다. 더 넓은 간격은 더 큰 불확실성을 나타냅니다.

기계 학습의 Confidence Intervals 계산

기계 학습 예측에 대한 자신감을 계산하는 것은 데이터 가변성 및 모델 불확실성을 고려하는 통계 방법. 하나의 일반적인 접근법은 여러 모델이 예측 가변성을 예측하기 위해 다른 데이터 하위 세트에 훈련되는 부츠 스트랩 샘플링을 사용하는 것입니다.

또 다른 방법은 예측 오류에 대한 배포를 가정하고 표준 편차에 따라 간격을 계산하고 이러한 오류의 의미를 계산하는 것입니다. 이 접근법은 종종 재발견 모델과 함께 사용됩니다.

통합 간섭

신뢰 간격은 예측의 진실한 가치를 포함할 수 있는 범위를 제공합니다. 예를 들면, 95% 신뢰 간격은 동일한 과정이 반복한 다수 시간인 경우에, 간격의 대략 95%가 진실한 가치를 포함할 것이라는 점을 의미합니다.

진정한 가치를 보장하지 않는 신뢰 간격이 특정 예측의 간격 내에서 보장하지 않는 것을 이해하는 것이 중요합니다, 그러나 오히려 많은 표본에 estimation 과정의 신뢰성을 반영합니다.

기계 학습의 신청

Confidence 간격은 다음과 같은 다양한 기계 학습 작업에서 유용합니다.

  • 회귀 예측의 불확실성을 구합니다.
  • 특징 중요성
  • 모델 비교 및 검증
  • 불확실한 밑에 Decision-making