Luokan epätasapainoa esiintyy, kun tietyt tietokokonaisuuden luokat ovat merkittävästi aliedustettuja muihin verrattuna. Tämä epätasapaino voi johtaa huonoon mallisuoritukseen, erityisesti sellaisissa tehtävissä kuin luokittelu, joissa vähemmistöluokat ovat kriittisiä. Luokan epätasapainon korjaaminen on olennaista tarkkojen ja luotettavien hermoverkkojen kehittämiseksi.

Yleiset tekniikat luokan epätasapainon osoittamiseksi

Neuroverkkojen luokkatasapainon lievittämiseen käytetään useita menetelmiä, joita voidaan soveltaa erikseen tai yhdistää parempien tulosten saavuttamiseksi.

Tietotason menetelmät

Tietotason lähestymistavat muuttavat tietokokonaisuutta tasapainottamaan luokkajakaumaa. Näitä ovat:

  • Ylimäärä:[ Vähemmistöluokkien näytteiden määrän lisääminen, usein päällekkäisen tai synteettisen tiedon tuottamisen avulla.
  • Ottamisaste:[) Vähennetään enemmistöluokan näytteiden määrää vähemmistöluokkien mukaan.
  • SMOTE:[ Synteettinen vähemmistö Ylinäytteenottotekniikka luo uusia synteettisiä esimerkkejä vähemmistöluokille.

Algoritmitason tekniikat

Nämä menetelmät muokkaavat oppimisalgoritmia käsitelläkseen paremmin epätasapainoista dataa. Esimerkkejä ovat:

  • Kyseinen oppiminen:[ Määrittää vähemmistöluokkien suuremmat luokitteluvirhekustannukset.
  • Focal Loss:[ keskittyy koulutukseen vaikeasti luokiteltavissa oleviin esimerkkeihin, mikä vähentää helppojen negatiivisten vaikutusten vaikutusta.

Esimerkkejä reaalimaailman tiedoista

Lääketieteellisessä diagnoosissa tietoaineistoissa on usein vähemmän positiivisia tapauksia. Yliampumisen tai SMOTE-menetelmän käyttö voi parantaa mallin herkkyyttä. Petosten havaitsemisessa, jossa petolliset liiketoimet ovat harvinaisia, kustannusherkkä oppiminen auttaa mallin priorisoimaan näiden tapausten tunnistamisen tehokkaasti.