نظم الرقابة والتألق
كيفية حساب الانتقائية في نظم قاعدة البيانات الواسعة النطاق
Table of Contents
ويعد الانتقائية من المؤشرات القياس الرئيسي في نظم قواعد البيانات الواسعة النطاق التي تساعد على تحديد كفاءة مؤشر نتائج الاستفسارات، وهي تقيس الطابع الفريد للقيم المخزنة في عمود ما مقارنة بمجموع عدد الصفوف في جدول ما، ويمكن فهم كيفية حساب الانتقائية من حيث المؤشرات أن يحسن أداء الاستفسارات ويحسن تصميم قواعد البيانات.
فهم الانتقائية
ويُعبر عن الانتقائية الفهرسية كنسبة أو نسبة مئوية، ويشير ارتفاع الانتقائية إلى أن عمود المؤشر يتضمن قيماً فريدة كثيرة، تعود بالنفع على عملية تصفية الاستفسارات، وعلى العكس من ذلك، فإن الانتقائية المنخفضة توحي بوجود قيم مزدوجة كثيرة، مما يجعل المؤشر أقل فعالية بالنسبة لبعض الاستفسارات.
حساب التصنيف
والصيغة الأساسية لانتقائية المؤشرات هي:
Index Selectivity = Number of Unique Values / Total Number of Rows]
فعلى سبيل المثال، إذا كان الجدول يحتوي على 000 10 صف، وكان العمود يحتوي على 000 1 قيم فريدة، فإن الانتقائية هي:
0.1 أو 10٪ ]
آثار الانتقائية
وتشير الانتقائية العالية (المنشورة إلى 1) إلى أن من المرجح أن يؤدي الرقم القياسي إلى تحسين أداء الاستفسارات بشكل كبير، لا سيما فيما يتعلق بالبحث عن المساواة، ويشير انخفاض الانتقائية إلى أن المؤشر قد لا يكون فعالاً، وقد تكون هناك حاجة إلى استراتيجيات بديلة للأرقام القياسية.
اعتبارات إضافية
وتؤثر عوامل مثل توزيع البيانات، وأنماط الاستفسار، وعبء العمل في قاعدة البيانات على فائدة المؤشر، ويمكن أن يسترشد في جهود التحليل الأمثل لقاعدة البيانات.