Table of Contents
Edge 장치는 제한된 컴퓨팅 리소스와 전력을 가지고 있으며 효율적인 딥러닝 아키텍처의 디자인을 만듭니다. 이 문서는 이러한 장치에서 배포하기위한 모델을 최적화하는 주요 원칙과 계산에 대해 논의합니다.
효율적인 건축 설계의 원칙
가장자리 장치에 대한 설계는 성능과 모델 복잡성을 균형 잡히는 데 필요합니다. 주요 원칙은 모델 크기, 소형 컴퓨팅 하중, 유지 정확도를 감소시킵니다. 모델 Pruning, quantization 및 아키텍처 최적화와 같은 기술은 일반적으로 고용됩니다.
Model Optimization에 대한 계산
계산은 가장자리 배치를 위한 모형의 한 벌을 결정하는 것을 돕습니다. 중요한 미터는 모수, FLOPs (점 가동) 및 기억 발자국의 수를 포함합니다. 예를 들면, 모수의 수를 감소시키십시오 모형 크기와 inference 시간을 감소시킬 수 있습니다.
효율성을위한 기술
- 모델 Pruning: 크기를 줄이기 위해 중복 중량을 제거.
- Quantization: 낮은 정밀도 데이터 유형을 사용하여 계산을 줄일 수 있습니다.
- Knowledge Distillation:] 더 큰 것들을 mimic에 더 작은 모델을 훈련.
- Architecture Search: 효율적인 모델의 디자인을 자동화.