Table of Contents
انحراف داده ها زمانی رخ می دهد که توزیع داده در سراسر پارتیشن های پایگاه داده یا گره ها ناهموار باشد، این عدم تعادل می تواند منجر به مسائل عملکردی شود، از جمله زمان پاسخ آهسته و افزایش مصرف منابع، تشخیص و مدیریت انحراف داده ها برای حفظ عملیات پایگاه داده کارآمد، به ویژه در سیستم های بزرگ.
Data Skew چیست؟
انحراف داده ها به توزیع نابرابر داده ها در بخش های مختلف یک پایگاه داده اشاره می کند، به جای اینکه یک بار متعادل داشته باشید، برخی از پارتیشن ها یا گره ها داده های قابل توجهی بیشتری نسبت به دیگران دارند.این عدم تعادل می تواند باعث ایجاد برخی از بخش های سیستم برای تبدیل شدن به تنگناها شود که بر عملکرد کلی تأثیر می گذارد.
نمونه های واقعی دنیای داده های Skew
در سیستم عامل های تجارت الکترونیک، دسته های محصول با محبوبیت بالا ممکن است مقدار زیادی از داده ها را تولید کنند، به عنوان مثال، یک محصول روند ممکن است منجر به تعداد زیادی از معاملات ذخیره شده در یک پارتیشن واحد شود، و باعث پاسخ های جستجوی آهسته برای داده های مرتبط شود.
تاثیر بر عملکرد پایگاه داده
انحراف داده می تواند باعث افزایش تاخیر، استفاده از CPU بالاتر و زمان اجرای طولانی مدت شود.هنگامی که گره های خاصی با داده ها غرق می شوند، سیستم ممکن است نیاز به انجام کار اضافی برای بازیابی یا پردازش اطلاعات، کاهش از طریق نفوذ و مقیاس پذیری کلی داشته باشد.
- پاسخ آهسته تر به سوالات
- افزایش مصرف منابع
- کاهش مقیاس پذیری سیستم
- امکان قطع سیستم