Guía práctica para la ampliación de los datos en el aprendizaje profundo: estrategias y cálculos
El aumento de datos es una técnica utilizada en el aprendizaje profundo para aumentar la diversidad de datos de capacitación sin recopilar nuevos datos. Ayuda a mejorar la generalización de modelos y reduce el exceso de adaptación. Esta guía cubre estrategias y cálculos comunes relacionados con el aumento de datos.
Estrategias de aumento de datos comunes
Se utilizan varias técnicas para aumentar los datos, especialmente en las tareas de procesamiento de imágenes. Estos métodos modifican los datos existentes para crear nuevas muestras variadas para la capacitación.
- Rotación:] Imágenes rotativas por cierto rango de grado.
- Escalar: Reactivar las imágenes manteniendo la relación de aspecto.
- Flipping:] Volteadores horizontales o verticales.
- El rompecabezas del color: Cambiar el brillo, el contraste o la saturación.
- Cropping:] Aleatorio o centro de cultivo para centrarse en diferentes partes de la imagen.
Cálculos para el aumento de datos
La aplicación de la intensificación de los datos implica calcular la probabilidad y el alcance de las transformaciones para garantizar la diversidad sin comprometer la integridad de los datos.
Por ejemplo, si se aplica la rotación dentro de un rango de 0° a 30°, el ángulo de rotación promedio se puede calcular como:
Rotación de promedio = (Mínimo + Máximo) / 2 = (0° + 30°) / 2 = 15°
De manera similar, al aplicar el cultivo aleatorio, el tamaño de la cosecha puede determinarse sobre la base del tamaño de la imagen original y el porcentaje de cobertura deseado.
Beneficios de la ampliación de datos
Utilizar técnicas de aumento de datos puede llevar a mejorar el rendimiento de los modelos exponiendo el modelo a una variedad más amplia de datos. También ayuda a reducir el exceso de adaptación, especialmente cuando los datos de capacitación son limitados.