Table of Contents
저전력 애플리케이션을 위한 네이티브 네트워크 아키텍처를 설계하면, 정확도를 유지하면서 데이터 처리가 신속하게 모델을 만들 수 있습니다. 이 모델은 자율 차량, 모바일 장치 및 온라인 게임과 같은 실시간 시스템에 필수적입니다. 목표는 희생 성능 없이 지연을 줄이기 위한 것입니다.
저전력 신경 네트워크의 핵심 원칙
몇몇 원리는 저경도 신경 네트워크의 발달을 인도합니다. 이들은 모형 단순성, 능률적인 계산 및 낙관한 기계설비 사용법을 포함합니다. Simplified 모형에는 몇몇 모수가 있기 때문에, 어느 것이 inference 시간을 가속화합니다. 능률적인 계산은 이동할 수 있는 장치를 위해 낙관된 convolutional 층과 같은 표적 기계설비에 빠르는 가동을 포함합니다.
대기시간 감소
기술 수명을 줄이기 위해 모델의 펀딩, 정량화 및 아키텍처 디자인이 포함되어 있습니다. 모델의 펀딩은 불필요한 무게, 감소 모델 크기 및 계산을 제거합니다. Quantization은 무게와 활성화의 정밀도를 감소시킵니다. 몇 층 또는 MobileNet과 같은 경량 모델을 사용하여 설계 아키텍처는 크게 늦게 대기 시간을 줄일 수 있습니다.
Deployment에 대한 고려
저전력 신경망을 배포할 때 하드웨어 호환성이 중요합니다. 배포 환경의 기능과 일치하는 모델을 선택하면 최적의 성능을 보장합니다. 또한 실제 조건에서 테스트 모델은 병목을 식별하고 인스톱 속도를 최적화하는 데 도움이됩니다.