Table of Contents
یادگیری فوق العاده مبتنی بر کیفیت داده های ارائه شده به الگوریتم ها است. پیش پردازش داده ها و مهندسی ویژگی گام های ضروری هستند که بر دقت و اثربخشی مدل های یادگیری ماشین تأثیر می گذارد.
پردازش داده ها
پیش پردازش داده ها شامل تمیز کردن و تبدیل داده های خام به یک فرمت مناسب برای مدل سازی است.این مرحله به موضوعاتی مانند ارزش های از دست رفته، نویز و ناسازگاری می پردازد. تکنیک ها شامل عادی سازی، مقیاس پذیری و رمزگذاری متغیرهای کاتالیک هستند.
مهندسی
مهندسی ویژگی های جدید ایجاد می کند یا ویژگی های موجود را برای بهبود عملکرد مدل ایجاد می کند.این به برجسته کردن اطلاعات مربوطه و کاهش ابعاد مهندسی ویژگی موثر کمک می کند تا به طور قابل توجهی قدرت پیش بینی مدل ها را افزایش دهد.
تکنیک های کلیدی در مهندسی ویژگی
- [[۱] [۱۰] انتخاب: [[۱۰] [۱۰] [۱]] انتخاب مناسب ترین ویژگی های مدل.
- استخراج مواد اولیه: ایجاد ویژگی های جدید از داده های موجود، مانند تجزیه و تحلیل جزء اصلی (PCA)
- رمزگذاری: تبدیل داده های کاتالیک به فرمت عددی.
- ترجمه: اعمال توابع ریاضی برای بهبود خطی بودن.