Dataförstärkning är en teknik som används i djupt lärande för att öka mångfalden av utbildningsdata utan att samla in nya data. Det hjälper till att förbättra modellgeneraliseringen och minskar överdrivning. Denna guide täcker gemensamma strategier och beräkningar som är involverade i dataförstärkning.

Gemensamma dataförbättringsstrategier

Flera tekniker används för att öka data, särskilt i bildbehandlingsuppgifter. Dessa metoder ändrar befintliga data för att skapa nya, varierade prover för träning.

  • Rotation:] Roterande bilder med ett visst examensintervall.
  • Skala:] Begränsa bilder samtidigt som bildförhållandet upprätthålls.
  • Flipping: horisontella eller vertikala flips.
  • ] Färg Jittering: ] Ändra ljusstyrka, kontrast eller mättnad.
  • Kropping: Slumpmässigt eller centrera grödor för att fokusera på olika delar av bilden.

Beräkningar för dataförstärkning

Genomförande av dataförstärkning innebär beräkning av sannolikheten och omfattningen av omvandlingar för att säkerställa mångfald utan att kompromissa med dataintegriteten.

Om exempelvis rotationen tillämpas inom en rad 0° till 30° kan den genomsnittliga rotationsvinkeln beräknas som:

]Genomsnittlig rotation[ = (Minimum + Maximum) / 2 = (0° + 30°) / 2 = 15°

På samma sätt, när man applicerar slumpmässig beskärning, kan grödans storlek bestämmas baserat på den ursprungliga bildstorleken och önskad täckningsprocent.

Fördelar med dataförbättring

Använda dataförsämringstekniker kan leda till förbättrad modellprestanda genom att exponera modellen för en bredare mängd data. Det hjälper också till att minska överdrivning, särskilt när träningsdata är begränsad.