Table of Contents
کیفیت صلیب یک روش آماری است که برای ارزیابی عملکرد مدل های یادگیری ماشین استفاده می شود.این به ارزیابی اینکه چگونه یک مدل به یک مجموعه داده مستقل تعمیم می یابد، کمک می کند.
درک اعتبار صلیب
انتقال صلیب شامل تقسیم داده ها به زیرمجموعه ها، آموزش مدل در برخی از این زیرمجموعه ها و تست آن در دیگران است.این فرآیند چندین بار تکرار می شود تا یک متریک عملکرد متوسط را به دست آورد. متداول ترین روش آن، معادل دوگانه است، جایی که داده ها به قطعات برابر تقسیم می شوند.
محاسبه در اعتباربخشی صلیب
در محدوده ی k-folding، مراحل زیر انجام می شود:
- داده ها را به قطعات برابر k تقسیم کنید.
- برای هر تکرار، یک بخش را به عنوان مجموعه تست و قطعات k-1 باقی مانده به عنوان مجموعه آموزش انتخاب کنید.
- مدل را در مجموعه آموزش آموزش و ارزیابی آن در مجموعه تست آموزش دهید.
- اندازه عملکرد را ثبت کنید، مانند دقت یا خطای مربعی.
- تکرار کنید تا تمام قطعات به عنوان مجموعه تست استفاده شود.
عملکرد کلی با میانگین معیارهای به دست آمده در هر تکرار محاسبه می شود، این برآورد قوی تری از اثربخشی مدل را فراهم می کند.
بهترین روش ها برای اعتباربخشی به صلیب
برای اطمینان از ارزیابی دقیق، این بهترین شیوه ها را در نظر بگیرید:
- مقدار مناسب k را انتخاب کنید، مانند 5 یا 10، بسته به اندازه مجموعه داده ها.
- اطمینان حاصل کنید که داده ها قبل از تقسیم بندی برای جلوگیری از سوگیری، به تعویق افتاده اند.
- استفاده از تقسیم بندی شده برای مجموعه داده های عدم تعادل برای حفظ توزیع کلاس.
- ترکیب متقابل-validation با تنظیم hyperparameter برای نتایج مطلوب.
- از نشت داده ها با جلوگیری از افشای اطلاعات بین آموزش و مجموعه های آزمایشی احتیاط کنید.