Guide pratique pour normaliser les intrants pour améliorer la performance des réseaux neuronaux
La normalisation des intrants est une étape cruciale dans la préparation des données pour les réseaux neuronaux. Elle contribue à améliorer la stabilité de la formation et les performances des modèles en veillant à ce que les caractéristiques des intrants soient à une échelle similaire.
Pourquoi normaliser les entrées?
Les réseaux neuraux fonctionnent mieux lorsque les données d'entrée sont normalisées car elles réduisent les chances de certaines caractéristiques dominant d'autres. La normalisation peut conduire à une convergence plus rapide pendant l'entraînement et une meilleure précision.
Techniques communes de normalisation
- Scalage Min-Max: Redimensionne les caractéristiques à une plage fixe, habituellement [0, 1].
- Normement:[ Centre les données autour de zéro avec un écart type d'un.
- Écalage de la buste:[ Utilise la plage médiane et interquartile pour réduire l'influence des valeurs aberrantes.
Mise en œuvre de la normalisation
La normalisation peut être mise en œuvre en utilisant des bibliothèques comme scikit-learn dans Python. Il est recommandé d'adapter l'échelleur sur les données de formation et ensuite appliquer la même transformation aux données de validation et de test pour éviter les fuites de données.
Exemple de code de normalisation :
à partir de sklearn.prétraitement importation StandardScaler
échelleur = StandardScaler()
train scaled = scaler.fit transform(X train)
X test scaled = scaler.transform(X test)