L'apprentissage approfondi a fondamentalement modifié le paysage de l'ingénierie, permettant aux systèmes de détecter les anomalies de la santé structurelle, d'optimiser les conceptions aérodynamiques et de prévoir les défaillances de l'équipement avant qu'elles ne se produisent. Sa capacité à apprendre des relations complexes et non linéaires à partir de données brutes en a fait un outil indispensable dans des domaines allant du génie civil à l'aérospatiale et à la fabrication. Pourtant, pour toute sa promesse, un goulot d'étranglement persistant limite son adoption généralisée dans des environnements d'ingénierie réels : la rareté de données de haute qualité et étiquetées.

Comprendre la rareté des données en ingénierie

Dans de nombreuses applications techniques, la collecte de données est entravée par des limitations physiques, des préoccupations de sécurité et des barrières exclusives. Par exemple, la saisie de données sur les défaillances d'infrastructures essentielles comme les ponts, les turbines ou les aéronefs nécessite des années d'exploitation dans des conditions défavorables, et même alors, les défaillances peuvent être trop rares pour produire des ensembles de données statistiquement significatifs. De même, dans le domaine de l'ingénierie biomédicale, l'acquisition de données d'imagerie médicale marquées pour des pathologies rares exige des essais cliniques approfondis et une annotation d'expert, des coûts de conduite prohibitifs.

Les facteurs suivants contribuent au problème de pénurie de données en ingénierie :

  • L'accès limité aux données exclusives:[ Les entreprises d'ingénierie traitent les données opérationnelles comme des données de propriété intellectuelle.Le partage de données entre les organisations – même pour la recherche collaborative – est souvent limité par des préoccupations juridiques et concurrentielles, créant des silos de données isolés.
  • Frais élevés d'étiquetage et d'annotation:[ Contrairement aux ensembles de données d'image à l'échelle d'Internet qui peuvent être étiquetés par l'intermédiaire de l'approvisionnement en foule, les données d'ingénierie nécessitent une expertise de domaine.
  • Événements rares ou extrêmes :[ De nombreux modèles d'apprentissage en profondeur de l'ingénierie visent à prédire les défaillances (p. ex., surtension du compresseur dans les turbines à gaz, propagation des fissures dans le béton).
  • Contraintes physiques et de sécurité :[ Il peut être impossible de faire des expériences pour produire plus de données en raison du coût, du temps ou du risque.
  • Complicité du système et non-stationnalité:[ Les systèmes d'ingénierie fonctionnent souvent dans des conditions variables (charge, température, humidité).Un modèle formé sur les données d'une saison ou d'un régime d'exploitation peut ne pas se généraliser à une autre, rendant les données disponibles encore plus rares lorsqu'elles sont stratifiées par condition d'exploitation.

Impacts de la rareté des données sur les modèles d'apprentissage profond

Lorsque les données de formation sont limitées, les modèles d'apprentissage profond, en particulier ceux qui ont des millions de paramètres, sont imprévisibles. Les conséquences vont au-delà des simples mesures de précision; elles affectent la sécurité, la robustesse et l'utilité pratique du modèle dans la prise de décision en ingénierie.

Suradaptation et généralisation médiocre

Un modèle sur-adapté peut obtenir des performances presque parfaites sur l'ensemble de l'entraînement, mais il échoue catastrophiquement sur de nouvelles entrées invisibles. En ingénierie, lorsque les décisions impliquent souvent des systèmes critiques pour la sécurité, une telle défaillance est inacceptable. Par exemple, un modèle d'apprentissage profond formé sur seulement 50 signaux de vibration pour détecter des défauts de roulement peut classer un roulement normal comme défectueux simplement parce que le profil sonore correspond à un des rares exemples d'entraînement.

Incapacité à apprendre des fonctionnalités robustes

L'apprentissage profond se développe sur des hiérarchies de caractéristiques en haute dimension. Lorsque les données sont rares, le modèle ne peut pas apprendre de façon fiable les caractéristiques discriminatives. Il prend plutôt en compte des corrélations fallacieuses qui se produisent dans l'ensemble de formation limité – par exemple, associer une couleur de fond spécifique dans une image infrarouge avec un défaut matériel, plutôt que la signature thermique réelle.

Précision et fiabilité inférieures aux prévisions

Les mesures quantitatives telles que la précision, le rappel et le score F1 souffrent lorsque les données sont rares. Plus important encore, l'étalonnage de confiance devient peu fiable. Un modèle peut produire un score de confiance élevé même pour les prédictions erronées, ce qui conduit les ingénieurs à faire confiance aux sorties incorrectes.

Incertitude accrue dans la prise de décisions

La rareté des données augmente intrinsèquement l'incertitude épistémique, l'incertitude due au manque de connaissance du modèle réel. Sans suffisamment de données pour limiter l'espace d'hypothèse du modèle, les prédictions deviennent très incertaines. Les ingénieurs qui s'appuient sur ces modèles pour optimiser la conception ou évaluer les risques sont laissés avec de larges intervalles de confiance qui rendent la sortie pratiquement inutile.

Stratégies clés pour surmonter la pénurie de données

Malgré les défis, la communauté de l'apprentissage en profondeur a développé une trousse robuste pour lutter contre la pénurie de données, qui va des approches purement centrées sur les données (augmentation, génération synthétique) aux approches centrées sur les algorithmes (apprentissage par transfert, modèles fondés sur la physique).

Augmentation des données pour les domaines d'ingénierie

Dans les tâches d'ingénierie basées sur l'image (p. ex., détection de fissures dans le béton, classification des défauts sur les surfaces métalliques), les augmentations standard comprennent des rotations aléatoires, des retournements, des réglages de luminosité et de contraste, et des injections de bruit gaussien. Les augmentations spécifiques à un domaine sont également puissantes : pour les données de capteur de séries chronologiques (vibrations, acoustiques, jauges de déformation), des techniques comme les changements aléatoires de temps, l'échelle d'amplitude et le mélange de signaux (p. ex., combinant des signaux provenant de différentes conditions d'exploitation) peuvent améliorer de façon significative la robustesse. Une étude de 2021 sur le diagnostic de défaillance de machines tournantes a révélé qu'une combinaison de séries chronologiques de culture et d'augmentation de mélanges a réduit l'erreur de classification de plus de 30 % lorsque seulement 50 échantillons par classe étaient disponibles (voir Systèmes mécaniques et traitement des signaux ). La clé est de s'assurer que les données augmentées demeurent physiquement plausibles - en réduisant le bruit irréaliste ou en faussant la physique peut nuire aux performances.

Transfert de l'apprentissage et adaptation des domaines

Dans la vision informatique, les réseaux pré-formés sur ImageNet ont été adaptés avec succès pour détecter les défauts sur les pales de turbine ou les fissures dans les ponts avec un nombre aussi limité que 100 images marquées. Pour les séries chronologiques, les auto-encodeurs ou les architectures basées sur ResNet, pré-formés sur la reconnaissance d'activités humaines à grande échelle ou les repères de capteurs industriels, peuvent être adaptés pour des tâches spécifiques de diagnostic de défaillance. L'adaptation du domaine, une variante plus avancée, traite le cas où les distributions de données source et cible diffèrent en raison des conditions de placement, d'environnement ou d'exploitation des capteurs.

Production de données synthétiques par simulation et GAN

Lorsque les données réelles sont rares, des données synthétiques peuvent être générées par des simulations basées sur la physique ou des modèles d'apprentissage approfondi génératifs. Des modèles à éléments finis de haute fidélité, des simulations de dynamique des fluides informatiques (CFD) et des logiciels de dynamique multi-corps peuvent produire des données marquées pour presque n'importe quel scénario d'ingénierie, des distributions de contraintes aux coefficients aérodynamiques. Le défi est que des écarts de simulation à réel (sim2real) – différences entre le comportement simulé et réel du capteur – peuvent dégrader le transfert de modèle.

Réseaux neuronaux formés en physique (RINP)

Les réseaux neuronaux éclairés par la physique intègrent des lois physiques — généralement des équations différentielles partielles (EDP) — directement dans la fonction de perte, réduisant ainsi la quantité de données marquées nécessaires. Au lieu de s'appuyer uniquement sur des paires d'entrées-sorties, les PINN sont également optimisés pour satisfaire les équations, les conditions limites et les lois de conservation.Par exemple, dans le domaine de la mécanique structurelle, un PINN formé à une poignée de mesures de contrainte peut encore prédire le champ de stress complet en imposant l'équilibre et les relations constitutives.Cette approche a été appliquée avec succès pour résoudre des problèmes de dynamique des fluides, de transfert de chaleur et de caractérisation matérielle inverse.

Quelques apprentissages et méta-apprentissages chauds

L'apprentissage par ordinateur à faible intensité (FSL) vise à former des modèles qui peuvent se généraliser à partir d'une poignée d'exemples par classe. Méta-learning, ou «apprentissage à apprendre», forme un modèle à travers de nombreuses tâches afin qu'il puisse s'adapter rapidement à une nouvelle tâche avec quelques étapes de gradient. En ingénierie, des réseaux prototypes ou méta-learning par modèle-agnostique (MAML) ont été appliqués au diagnostic de défaillance avec seulement 5 à 10 échantillons par type de faille. Le méta-modèle apprend un extracteur de caractéristiques partagées qui capture des modèles fondamentaux (p. ex., des pics spectraux associés à des défauts de roulement) et par la suite finisse une couche classificateur sur les quelques exemples cibles disponibles.

Partage de données en collaboration et apprentissage fédéré

Pour de nombreuses organisations d'ingénierie, le problème de la rareté des données n'est pas absolu mais collectif : chaque entité possède un petit ensemble de données privées qui, lorsqu'elles sont combinées, seraient suffisantes pour former des modèles robustes. Le partage collaboratif des données, régi par des accords d'utilisation des données, peut regrouper des échantillons provenant de plusieurs sites, installations ou entreprises. Par exemple, les modèles de maintenance prédictive pour les éoliennes peuvent bénéficier de données de vibration recueillies dans plusieurs parcs éoliens.

Approches hybrides et globales

L'utilisation de méthodes combinées, comme l'augmentation des données pour élargir un petit ensemble de données réelles, puis l'ajout d'une régularisation adaptée à la physique pendant l'entraînement, donne des résultats plus forts. L'apprentissage en ensemble, où plusieurs modèles formés sur différents sous-ensembles ou avec différentes architectures sont combinés, peut également atténuer la variance causée par des données peu nombreuses. Le marquage (agrégat bootstrap) crée plusieurs versions piégées de l'ensemble de données limité et forme des modèles séparés, puis en calcule les prédictions en moyenne.

Conclusion

La rareté des données demeure un défi redoutable pour déployer un apprentissage profond dans les applications d'ingénierie, mais il n'est pas insurmontable. Le large éventail de stratégies - allant de l'augmentation des données et du transfert de l'apprentissage vers les réseaux neuronaux éclairés en physique et le partage collaboratif des données - fournit aux ingénieurs un riche écosystème d'outils pour construire des modèles efficaces même lorsque les données sont limitées. Aucune approche unique ne convient à tous les problèmes; la mise en oeuvre réussie exige une compréhension approfondie du domaine de l'ingénierie et des forces et faiblesses de chaque technique.