A seletividade do índice é um fator chave na otimização do desempenho da consulta SQL. Ele mede quão bem um índice filtra dados, influenciando a velocidade da recuperação de dados. Compreender e calcular a seletividade do índice pode ajudar os administradores de banco de dados a melhorar a eficiência da consulta escolhendo os índices mais eficazes.

O que é a seletividade do índice?

Seletividade do índice refere-se à proporção de valores únicos em uma coluna em relação ao número total de linhas. Alta seletividade indica que a coluna tem muitos valores únicos, tornando os índices mais eficazes. Por outro lado, baixa seletividade sugere muitos valores duplicados, reduzindo a utilidade do índice.

Calculando a Seletividade do Índice

A fórmula para seletividade do índice é simples:

Seletividade = Número de Valores Únicos / Número Total de Linhas

Por exemplo, se uma tabela tem 1.000 linhas e uma coluna com 900 valores únicos, a seletividade é 0,9, indicando alta eficácia para indexação.

Exemplo de Dados Verdadeiros

Considere uma tabela de dados do cliente com 10.000 linhas. A coluna "País" contém 50 nomes de países únicos. A seletividade é:

0.005 = 50 / 10.000

Essa baixa seletividade sugere que a indexação da coluna "País" pode não melhorar significativamente o desempenho da consulta. Ao invés disso, focar em colunas com maior seletividade, como "ID do cliente", que tem 10.000 valores únicos, seria mais benéfico.

Implicações para a Otimização de Consultas

Calcular a seletividade do índice ajuda a decidir quais colunas indexar. Colunas de alta seletividade são tipicamente melhores candidatos para indexação, levando a uma execução mais rápida da consulta. Colunas de baixa seletividade podem ser mais adequadas para outras estratégias de otimização ou índices compostos.