Table of Contents
बायस और विविधता पर्यवेक्षित सीखने में महत्वपूर्ण अवधारणाएं हैं जो मॉडल के प्रदर्शन का मूल्यांकन करने में मदद करती हैं। इन मीट्रिकों की गणना करने के बारे में समझने के लिए मॉडल चयन और ट्यूनिंग में सुधार हो सकता है।
बिआस और विविधता को समझना
बायस एक सरलीकृत मॉडल के साथ एक वास्तविक दुनिया की समस्या को अनुमानित करके पेश की गई त्रुटि को संदर्भित करता है। विविधता यह मापती है कि विभिन्न प्रशिक्षण डेटासेट के लिए मॉडल की भविष्यवाणी कितनी फ्लुक्ल्यूट होती है। दोनों मॉडल की सटीकता और सामान्यीकरण क्षमता को प्रभावित करते हैं।
बिलास की गणना
बायस की गणना मॉडल की औसत भविष्यवाणी की तुलना करके वास्तविक मूल्य तक की जाती है। चरणों में शामिल हैं:
- विभिन्न प्रशिक्षण डेटासेट पर कई बार मॉडल ट्रेन करें।
- प्रत्येक बार एक निश्चित परीक्षण बिंदु के लिए आउटपुट को निर्धारित करें।
- इन भविष्यवाणियों के औसत की गणना करें।
- इस औसत और वास्तविक मूल्य के बीच अंतर को पूरा करें।
- इस अंतर को वर्गाकार पूर्वाग्रह वर्ग प्राप्त करने के लिए वर्गाकार किया गया है।
वैरिएशन की गणना
विविधता मॉडल की भविष्यवाणियों की परिवर्तनशीलता को मापती है। इसे समझने के लिए:
- विभिन्न डेटासेट पर प्रशिक्षित कई मॉडलों से भविष्यवाणियों का उपयोग करें।
- सभी मॉडलों में औसत भविष्यवाणी की गणना करें।
- इस अर्थ से प्रत्येक भविष्यवाणी के वर्गीय विचलन को निर्धारित करें।
- इन विचलनों को बदलने के लिए विविधता का औसतन।
प्रैक्टिकल उदाहरण
मान लीजिए कि आपके पास डेटासेट है और विभिन्न सबसेटों पर एक मॉडल को पांच बार प्रशिक्षित करें। एक विशिष्ट परीक्षण बिंदु के लिए, भविष्यवाणियां 3.2, 3.8, 3.5, 3.7 और 3.3 हैं। सही मान 4.0 है।
औसत भविष्यवाणी 3.5 है। पूर्वाग्रह वर्गित है (4.0 - 3.5)^2 = 0.25। विचलन की गणना 3.5 से प्रत्येक भविष्यवाणी के वर्गीय विचलन को औसतन की जाती है, जिसके परिणामस्वरूप 0.14 होता है।