Ang di - pagkakatimbang ng klase ay nangyayari kapag ang ilang klase sa isang dataset ay lubhang hindi kinakatawan kung ihahambing sa iba. Ang di - pagkakatimbang na ito ay maaaring humantong sa hindi mahusay na paggawa ng modelo, lalo na sa mga atas na gaya ng klasipikasyon kung saan ang mga klase ng minoridad ay kritikal.

Karaniwang Pamamaraan Upang Makausap ang Uri ng mga Klase

Ang ilang pamamaraan ay ginagamit upang ituon ang pagiging di - timbang ng klase sa mga network ng neuron.

Mga Paraan ng Pag - aaral ng Data-Level

Ang mga pamamaraang Data-level ay nagbabago ng dataset upang balansehin ang distribusyon ng klase. Kabilang dito ang:

  • [[Pampasa:] Dumarami ang sampol ng klaseng minoridad, kadalasan sa pamamagitan ng duplication o sintetikong henerasyon ng datos.
  • Pampasa sa ilalim: [[T:1] Nagpapababa sa bilang ng mga sampol ng karamihan upang tumugma sa mga klase ng minorya.
  • SMOTE: Ang Synthetic Minority Over-sampling Streature ay lumilikha ng mga bagong sintetikong halimbawa para sa mga klaseng minorya.

Algorithm-Level na Pamamaraan

Ang mga pamamaraang ito ay nagpapabago sa algorithm ng pagkatuto upang mas mabuting pangasiwaan ang hindi timbang na impormasyon. Ang mga halimbawa ay kinabibilangan ng:

  • Cost-sensitive learning: Asigns mas mataas na mga di-klaseng gastos sa mga klaseng minorya.
  • Focal Loss: Itutuon ang pagsasanay sa mga hard-to-classified halimbawa, binabawasan ang epekto ng mga madaling negatibo.

Mga Halimbawa ng Real-World Data

Sa medikal na diyagnosis, ang mga dataset ay kadalasang naglalaman ng mas kaunting positibong mga kaso. Ang paglalapat ng oversampling o SMOTE ay maaaring mapabuti ang sensitivity ng modelo. Sa scam diagnost, kung saan ang mga pandarayang transaksiyon ay bihira, ang mga gastos-sensitive na pagkatuto ay tumutulong sa modelo na makilala nang epektibo ang mga kasong ito.