Object Detection 시스템은 종종 이미지 내의 다른 크기로 표시되는 스케일 변형으로 인한 직면 과제를 직면합니다. 이 문제를 해결하는 것은 감시, 자율 차량 및 이미지 분석과 같은 다양한 응용 분야에서 정확성과 견고성을 개선하는 데 필수적입니다. Mathematical 기술은 모델의 크기를 인식하는 능력에 따라 스케일 변형의 효과를 완화하는 데 도움이 될 수 있습니다.

Multi-Scale 특징 추출

하나의 일반적인 접근법은 여러 가지 규모로 특징을 추출하는 것이 포함됩니다. 이미지 피라미드와 같은 기술은 다양한 크기의 개체를 감지 할 수 있도록 다른 해상도로 이미지를 크기를 조정합니다. 복잡한 신경 네트워크 (CNNs)는 다양한 레이어에서 정보를 처리하는 전문 아키텍처를 통해 멀티 스케일 기능을 통합 할 수 있습니다.

규모 Invariance를 위한 수학 기술

확장형 이론과 같은 수학 방법은 안정된 기능을 식별하기 위해 다른 스케일의 이미지 분석. Gaussian (LoG)의 라플리아와 Gaussians (DoG)의 차이는 변화에 대한 비동기적 인 blobs 및 키 포인트를 감지하는 데 사용됩니다. 이 기술은 크기 변화에도 불구하고 일관성있는 d를 유지하는 기능을 만드는 데 도움이됩니다.

정상화 및 데이터 Augmentation

정상적인 기술은 훈련 도중 목표 크기를 조정하고, 모형을 가늠자 다름에 더 과민하게 만드는 것을. 무작위 스케일링과 자르기와 같은 자료 낙관 방법은, 각종 목표 크기에 모형을, 가늠자의 맞은편에 종합하는 그들의 능력을 개량합니다.

기술 개요

  • Multi-scale 기능 추출
  • Scale-space 분석
  • 정상화 및 낙농
  • 신경 네트워크의 건축 혁신