عدم تعادل کلاس زمانی اتفاق می افتد که کلاس های خاصی در مجموعه داده ها نسبت به دیگران به طور قابل توجهی کمتر نشان داده شوند، این عدم تعادل می تواند منجر به عملکرد ضعیف مدل شود، به ویژه در وظایفی مانند طبقه بندی که در آن کلاس های اقلیت برای ایجاد شبکه های عصبی دقیق و قابل اعتماد ضروری است.

تکنیک های رایج برای پاسخگویی به تعادل کلاس Im

روش های مختلفی برای کاهش عدم تعادل طبقاتی در شبکه های عصبی استفاده می شود.این تکنیک ها می توانند به صورت جداگانه یا ترکیب شده برای نتایج بهتر استفاده شوند.

روش های Data-Level

روش های سطح داده، داده ها را برای تعادل توزیع کلاس تغییر می دهند.این موارد عبارتند از:

  • خلاصه: افزایش تعداد نمونه های کلاس اقلیت، اغلب از طریق تکراری یا نسل داده مصنوعی.
  • زیر ریزه کردن: کاهش تعداد نمونه های کلاس اکثریت برای مطابقت با کلاس های اقلیت.
  • ، اقلیت مصنوعی بیش از حد نمونه سازی نمونه های مصنوعی جدید برای کلاس های اقلیت ایجاد می کند.

تکنیک های الگوریتم-Level

این روش ها الگوریتم یادگیری را برای بهتر مدیریت داده های عدم تعادل تغییر می دهند.

  • یادگیری حساس به ارزش: [FLT 1] هزینه های طبقه بندی نادرست بالاتر را به کلاس های اقلیت اختصاص می دهد.
  • زیانبار؛ تمرکز بر آموزش بر نمونه های سخت به طبقه بندی، کاهش تاثیر منفی آسان است.

مثال های داده های واقعی-World Data

در تشخیص پزشکی، داده ها اغلب شامل موارد مثبت کمتری هستند که استفاده از بیش از حد و یا SMOTE می تواند حساسیت مدل را بهبود بخشد.در تشخیص تقلب، که در آن معاملات جعلی نادر هستند، یادگیری حساس به هزینه کمک می کند تا مدل شناسایی این موارد به طور موثر.