क्लास असंतुलन मशीन लर्निंग में एक आम चुनौती है जहां एक वर्ग दूसरों को काफी बहिष्कार करता है। यह असंतुलन पूर्वाग्रहित मॉडलों का कारण बन सकता है जो अल्पसंख्यक वर्गों पर खराब प्रदर्शन करते हैं। प्रभावी तकनीकों को लागू करने से भविष्यवाणी सटीकता और मॉडल निष्पक्षता में सुधार हो सकता है।

क्लास असंतुलन को समझना

क्लास असंतुलन तब होता है जब किसी डेटासेट में कक्षाओं का वितरण असमान होता है। उदाहरण के लिए, धोखाधड़ी का पता लगाने में, धोखाधड़ी का लेनदेन वैध लोगों की तुलना में बहुत कम होता है। यह असंतुलन बहुमत वर्ग के पक्ष में मॉडल का कारण बन सकता है, जिससे अल्पसंख्यक वर्ग के उदाहरणों का पता लगाया जा सकता है।

कक्षा असंतुलन को संबोधित करने की तकनीक

कई तरीके वर्ग असंतुलन मुद्दों को कम करने में मदद कर सकते हैं:

  • Resampling: डेटासेट को अतिभारित अल्पसंख्यक वर्गों या बहुमत वर्गों को कम करके समायोजित करें।
  • ]Synthetic Data Generation:] अल्पसंख्यक वर्गों के सिंथेटिक उदाहरण बनाने के लिए SMOTE जैसी तकनीकों का उपयोग करें।
  • ]Algorithmic दृष्टिकोण: Employ मॉडल जो असंतुलन के लिए मजबूत हैं, जैसे कि पहनावा विधियां।
  • Cost-संवेदनशील लर्निंग: अल्पसंख्यक वर्गों के लिए उच्च वर्गीकरण लागत को सौंप दें।

कक्षा असंतुलन का मूल्यांकन करने के लिए गणना

मीट्रिक असंतुलन और मॉडल प्रदर्शन की सीमा को निर्धारित करने में मदद करते हैं। आम गणना में शामिल हैं:

  • ]Imalignance अनुपात: अल्पसंख्यक वर्ग उदाहरणों के लिए बहुमत की संख्या का अनुपात।
  • प्रेसिजन और Recall: सकारात्मक भविष्यवाणियों की सटीकता और सभी सकारात्मक उदाहरणों को खोजने की क्षमता को मापें।
  • F1 स्कोर: Harmonic सटीक और याद का मतलब है, दोनों मीट्रिक संतुलन।