Table of Contents
کیفیت صلیب یک روش آماری است که برای ارزیابی عملکرد مدل های یادگیری ماشین استفاده می شود.این به ارزیابی اینکه چگونه یک مدل به داده های دیده شده تعمیم می یابد، کمک می کند تا خطر استفاده از تکنیک های موثر برای ساخت مدل های قوی را کاهش دهد.
درک اعتبار صلیب
انتقال صلیب شامل تقسیم مجموعه داده ها به زیرمجموعه های متعدد است.این مدل در برخی از زیرمجموعه ها آموزش داده می شود و بر روی دیگران آزمایش می شود.این فرآیند چندین بار تکرار می شود تا اطمینان حاصل شود که عملکرد مدل در سراسر تقسیم داده های مختلف سازگار است.
تکنیک های معتبر صلیب
چندین تکنیک برای انجام سطح متقابل استفاده می شود که هر کدام برای سناریوهای مختلف مناسب هستند:
- اعتبار صلیب سرخ: داده ها را به قطعات برابر "k" تقسیم می کند، آموزش در قطعات k-1 و آزمایش در مورد باقی مانده است.
- K-Fratified K-Fold: شبیه K-Fold اما توزیع کلاس در سراسر لایه، مفید برای مجموعه داده های غیر تعادل است.
- – یک-Out (LOO): از یک نقطه داده برای تست و بقیه برای آموزش استفاده می کند، تکرار شده برای هر نقطه داده.
بهترین روش ها برای اجرای
برای به حداکثر رساندن مزایای پاداش متقابل، بهترین شیوه های زیر را در نظر بگیرید:
- یک مقدار مناسب از "k" را بر اساس اندازه داده ها انتخاب کنید.
- اطمینان حاصل کنید که داده ها قبل از تقسیم بندی برای کاهش سوگیری، دچار مشکل می شوند.
- از روش های طبقه بندی شده برای مشکلات طبقه بندی با کلاس های عدم تعادل استفاده کنید.
- ترکیب متقابل-validation با تنظیم hyperparameter برای نتایج مطلوب.