یادگیری فوق العاده مبتنی بر کیفیت داده های ارائه شده به الگوریتم ها است. پیش پردازش داده ها و مهندسی ویژگی گام های ضروری هستند که بر دقت و اثربخشی مدل های یادگیری ماشین تأثیر می گذارد.

پردازش داده ها

پیش پردازش داده ها شامل تمیز کردن و تبدیل داده های خام به یک فرمت مناسب برای مدل سازی است.این مرحله به موضوعاتی مانند ارزش های از دست رفته، نویز و ناسازگاری می پردازد. تکنیک ها شامل عادی سازی، مقیاس پذیری و رمزگذاری متغیرهای کاتالیک هستند.

مهندسی

مهندسی ویژگی های جدید ایجاد می کند یا ویژگی های موجود را برای بهبود عملکرد مدل ایجاد می کند.این به برجسته کردن اطلاعات مربوطه و کاهش ابعاد مهندسی ویژگی موثر کمک می کند تا به طور قابل توجهی قدرت پیش بینی مدل ها را افزایش دهد.

تکنیک های کلیدی در مهندسی ویژگی

  • [[۱] [۱۰] انتخاب: [[۱۰] [۱۰] [۱]] انتخاب مناسب ترین ویژگی های مدل.
  • استخراج مواد اولیه: ایجاد ویژگی های جدید از داده های موجود، مانند تجزیه و تحلیل جزء اصلی (PCA)
  • رمزگذاری: تبدیل داده های کاتالیک به فرمت عددی.
  • ترجمه: اعمال توابع ریاضی برای بهبود خطی بودن.