Table of Contents
Data augmentation은 새로운 데이터를 수집하지 않고 교육 데이터의 다양성을 높이기 위해 딥러닝에 사용되는 기술입니다. 모델의 일반화 향상을 돕고 과감한 감소를 돕습니다. 이 가이드는 데이터 낙태에 관련된 일반적인 전략과 계산을 다룹니다.
일반적인 데이터 Augmentation 전략
몇몇 기술은 augment 자료에, 특히 이미지 처리 작업에서 사용됩니다. 이 방법은 기존의 자료를 수정하여 훈련을 위한 새로운, 변화한 표본을 창조합니다.
- Rotation: 특정 정도 범위로 이미지를 회전.
- Scaling: 이미지의 크기를 조절하여 측면 비율을 유지한다.
- Flipping: 수평 또는 수직 플립.
- 컬러 지터링:밝기, 대비, 또는 포화를 변경합니다.
- 자르기: 이미지의 다른 부분에 초점을 맞추기 위해 랜덤 또는 중심 작물.
Data Augmentation에 대한 계산
데이터 낙태를 구현하는 것은 데이터 무결성을 뛰어넘지 않고 다양성을 보장하기 위해 확률과 변화의 계산을 포함합니다.
예를 들어, 0° ~ 30° 범위 내에서 교체를 적용하면 평균 회전 각도는 다음과 같이 계산될 수 있습니다.
평균 회전 = (최소 + 최대) / 2 = (0° + 30°) / 2 = 15°
마찬가지로, 임의의의 작물을 적용 할 때, 작물 크기는 원본 이미지 크기 및 원하는 적용 비율을 기준으로 결정 될 수 있습니다.
Data Augmentation의 장점
데이터 낙하 기술을 사용하여 모델의 다양한 데이터로 폭발하여 모델의 성능을 향상 시킬 수 있습니다. 또한 교육 데이터가 제한될 때 과잉을 감소시키는 데 도움이 됩니다.