تعمیم مدل یک جنبه کلیدی از یادگیری عمیق است، تعیین اینکه چگونه یک مدل بر روی داده های ناشناخته عملکرد خوبی دارد.

اندازه گیری مدل عمومی سازی

برای ارزیابی اینکه یک مدل چقدر کلی می شود، لازم است که عملکرد آن را بر روی داده هایی که در طول آموزش استفاده نمی شود، ارزیابی کنیم. روشهای مشترک شامل استفاده از داده های معتبر و تست است که برآورد بی طرفانه عملکرد مدل را ارائه می دهد.

متریک هایی مانند دقت، دقت، یادآوری و نمره F1 برای ارزیابی عملکرد مورد استفاده قرار می گیرند.علاوه بر این، تکنیک هایی مانند کمک متقابل-validation در درک ثبات مدل در سراسر تقسیم داده های مختلف استفاده می شود.

تکنیک های بهبود عمومی سازی

چندین استراتژی می تواند توانایی مدل برای تعمیم روش های منظم سازی مانند L2 منظم سازی و خروج را افزایش دهد، از اضافه کردن محدودیت ها به فرآیند یادگیری جلوگیری کند.

افزایش داده ها تنوع داده های آموزشی را افزایش می دهد و به مدل کمک می کند تا ویژگی های قوی تری را یاد بگیرد.در ابتدا آموزش را متوقف می کند، زمانی که عملکرد داده های معتبر شروع به کاهش می کند، اجتناب از بیش از حد.

بهترین تمرین ها

مهم است که یک جدایی واضح بین آموزش، اعتبار و مجموعه داده های تست را حفظ کنید.به طور منظم نظارت بر عملکرد اعتبار سنجی در طول آموزش می تواند تنظیم hyperparameter را با استفاده از روش های گروه نیز بهبود بخشد تعمیم با ترکیب چند مدل.

  • استفاده از متقابل-validation برای تخمین های قابل اعتماد
  • استفاده از تکنیک های منظم
  • پیاده سازی داده ها
  • کارفرمایان در اوایل توقف
  • تست داده های دیده شده به طور منظم