Table of Contents
کیفیت صلیب یک روش آماری است که برای ارزیابی عملکرد مدل های یادگیری ماشین استفاده می شود.این به ارزیابی اینکه چگونه یک مدل به داده های دیده شده تعمیم می یابد، کمک می کند.طراحی و محاسبه مناسب برای به دست آوردن نتایج قابل اعتماد و اجتناب از بیش از حد یا کمتر از حد ضروری است.
اصول پایه اعتباربخشی صلیب
انتقال صلیب شامل تقسیم داده ها به زیرمجموعه ها، آموزش مدل در برخی از زیرمجموعه ها و تست آن بر روی دیگران است.این فرآیند برآورد عملکرد مدل را در داده های جدید فراهم می کند. متداول ترین روش آن است که k-fold متقابل-validation، که در آن داده ها به قطعات برابر تقسیم می شود.
طراحی ذهنیت
انتخاب پارامترهای مناسب بسیار مهم است.تعداد لایه ها (k) بر سوگیری و اختلاف نظرها تأثیر می گذارد.یک k بالاتر سوگیری را کاهش می دهد اما به طور معمول، k به 5 یا 10 برای نتایج متعادل تنظیم می شود. داده های جمع آوری شده به طور تصادفی قبل از تقسیم سوگیری به دلیل سفارش داده ها، تجزیه می شوند.
محاسبه برای نتایج قابل اعتماد
محاسبه میانگین متریک عملکرد در تمام لایه ها برآورد کلی را فراهم می کند.علاوه بر این، محاسبات انحراف استاندارد بینشی را در مورد تنوع عملکرد مدل ارائه می دهد.این به درک ثبات مدل کمک می کند.
- تقسیم داده ها به قطعات k مساوی
- آموزش در قسمت های k-1، تست در قسمت باقی مانده
- تکرار برای تمام قطعات k
- محاسبه معنی و انحراف استاندارد از معیارهای عملکرد