Table of Contents
L'apprendimento approfondito ha modificato fondamentalmente il paesaggio dell'ingegneria, consentendo ai sistemi di rilevare anomalie nella salute strutturale, ottimizzare i disegni aerodinamici e prevedere i guasti delle apparecchiature prima di esse. La sua capacità di apprendere complesse relazioni non lineari dai dati grezzi ha reso uno strumento indispensabile in campi che vanno dall'ingegneria civile all'aerospazio e alla produzione.
Capire la scarsità di dati in ingegneria
La carenza di dati in contesti ingegneristici è raramente una questione semplice di avere troppi pochi campioni. Si tratta di un problema sistemico radicato nella natura dei sistemi di ingegneria, i vincoli di distribuzione del mondo reale, e il costo di ottenere la verità del terreno. In molte applicazioni di ingegneria, la raccolta di dati è ostacolata da limitazioni fisiche, preoccupazioni di sicurezza e barriere proprietarie.
I seguenti fattori contribuiscono al problema della scarsità di dati nell'ingegneria:
- L'accesso ai dati proprietari:[[] Le aziende di ingegneria trattano i dati operativi come proprietà intellettuale. La condivisione dei dati tra le organizzazioni, anche per la ricerca collaborativa, è spesso limitata da preoccupazioni legali e competitive, creando silos dati isolati.
- Elevato costo di etichettare e annotare:[] Diversamente dai dataset di immagini su scala Internet che possono essere etichettati tramite crowd-sourcing, i dati ingegneristici richiedono competenze di dominio. L'etichettatura di una singola crepa di fatica in un micrografo metallico ad alta risoluzione può richiedere un metallurgista, e l'etichettatura dei segnali di sensori dinamici per il rilevamento richiede la conoscenza della busta operativa dell'intero sistema.
- Molti modelli di deep learning ingegneristici mirano a prevedere guasti (ad esempio, sovratensione del compressore nelle turbine a gas, propagazione della crepa in calcestruzzo), che si verificano raramente e sono difficili da riprodurre in condizioni controllate, con conseguente grave squilibrio dei dataset.
- I vincoli fisici e di sicurezza:[] Gli esperimenti in esecuzione per generare più dati possono essere impossibili a causa di costi, tempi o rischi. Ad esempio, le automobili di crash testing o la simulazione di risposte terremoti su strutture su scala completa non possono essere fatti a scala.
- Complessità del sistema e non-stazione:[[ I sistemi di ingegneria spesso operano in condizioni variabili (carico, temperatura, umidità). Un modello formato su dati da una stagione o regime operativo non può generalizzare ad un altro, rendendo i dati disponibili ancora più spartiti quando stratificato da condizioni operative.
Impatti della scarsità di dati sui modelli di apprendimento profondo
Quando i dati di formazione sono limitati, i modelli di apprendimento profondo, specialmente quelli con milioni di parametri, sono imprevedibilmente. Le conseguenze si estendono oltre metriche di precisione semplici; influiscono sulla sicurezza, sulla robustezza e sull'utilità pratica del modello nel processo decisionale di ingegneria.
Superfitting e Poveri Generalizzazione
Il superamento avviene quando un modello memorizza i campioni di allenamento piuttosto che imparare i modelli sottostanti. Con scarse informazioni, la capacità del modello di sovraccarico è amplificata. Un modello di overfit può ottenere prestazioni quasi perfette sul set di formazione, ma non riesce catastrofe su nuovi input, invisibili. In ingegneria, dove le decisioni spesso comportano sistemi critici per la sicurezza, tale fallimento è inaccettabile.
Incapacità di imparare le caratteristiche robuste
Quando i dati sono scarse, il modello non può imparare in modo affidabile le caratteristiche discriminatorie. Invece, raccoglie le correlazioni spurie che si verificano nel set di formazione limitato, ad esempio, associando un colore di sfondo specifico in un'immagine a infrarossi con un difetto materiale, piuttosto che la firma termica effettiva.
Precisione e affidabilità della prevenzione più bassa
Le metriche quantitative come precisione, richiamo e F1-score soffrono quando i dati sono radi. Più importante, la calibrazione della fiducia diventa inaffidabile. Un modello può produrre un punteggio di alta fiducia anche per previsioni sbagliate, portando gli ingegneri a fidarsi di uscite errate. In applicazioni come manutenzione predittiva, questo può portare a finestre di manutenzione mancate o sostituzioni inutili, entrambi i quali impatto diretto costi operativi e sicurezza.
Aumento dell'incertezza nella gestione delle decisioni
La scarsità di dati aumenta intrinsecamente l'incertezza epistemica, l'incertezza dovuta alla mancanza di conoscenza del modello vero. Senza sufficienti dati per limitare lo spazio di ipotesi del modello, le previsioni diventano altamente incerte. Gli ingegneri che si affidano a tali modelli per l'ottimizzazione del design o la valutazione del rischio sono lasciati con ampi intervalli di fiducia che rendono l'output praticamente inutile.
Strategie chiave per superare la scarsità di dati
Nonostante le sfide, la comunità di deep learning ingegneristica ha sviluppato un robusto toolkit per combattere la scarsità di dati, che spazia da approcci puramente data-centrici (aumento, generazione sintetica) a quelli algoritmi-centrici (apprendimento di trasferimento, modelli informativi fisici). Le soluzioni più efficaci spesso combinano più tecniche in un condotto su misura.
Aumento dei dati per i domini di ingegneria
In attività di ingegneria basata sulle immagini (ad esempio, rilevamento delle crepe in calcestruzzo, classificazione dei difetti su superfici metalliche), le accresciute standard includono rotazioni casuali, capovolte, regolazioni di luminosità e contrasto, e l'iniezione del rumore gaussiana.
Trasferimento di apprendimento e adattamento di dominio
L'apprendimento del trasferimento sfrutta un modello pre-trained su un grande, relativo dataset sorgente e lo perfeziona sulle piccole reti di progettazione. In visione del computer, le reti pre-trained su ImageNet sono state adattate con successo per rilevare i difetti sulle pale della turbina o le crepe nei ponti con appena 100 immagini etichettate.
Generazione di dati sintetici tramite simulazione e GAN
I dati di tipo reale sono scarse, i dati sintetici possono essere generati attraverso simulazioni basate sulla fisica o modelli di apprendimento profondo generativo. I modelli di elementi finiti ad alta fedeltà, le simulazioni di fluido computazionale (CFD) e il software multi-corpo dinamico possono produrre dati etichettati per quasi tutti gli scenari di ingegneria, dalle distribuzioni di stress ai coefficienti aerodinamici impiegati.
Reti neurali informatiche (PINN)
I dati di analisi e di analisi sono stati utilizzati per la valutazione di un sistema di analisi e di analisi dei dati.
Apprendimento e Meta-Learning a pochi colpi
Il meta-learning (FSL) si propone di formare modelli che possono generalizzare da una manciata di esempi per classe. I meta-learning, o "learning to learn", allenano un modello su molti compiti in modo che possa adattarsi rapidamente ad un nuovo compito con pochi gradienti passi.
Condivisione dei dati collaborativa e apprendimento federato
Per molte organizzazioni di ingegneria, il problema della scarsità di dati non è assoluto ma collettivo: ogni entità detiene un piccolo e privato set di dati che, quando combinato, sarebbe sufficiente per formare modelli robusti. La condivisione di dati collaborativi, regolata da accordi di utilizzo dei dati, può aggregare campioni da più siti, strutture o aziende.
Approcci ibridi e dell'Ensemble
I metodi di combinazione, come l'utilizzo di un'aumento dei dati per espandere un piccolo set di dati reale, quindi l'aggiunta di una regolarizzazione in forma fisica durante la formazione, possono anche attenuare la varianza causata da dati radianti.
Conclusioni
La mancanza di dati rimane una sfida formidabile per la distribuzione di deep learning nelle applicazioni di ingegneria, ma non è un modo insormontabile. L'ampio spettro di strategie, che vanno dalla accrescimento dei dati e dal trasferimento di apprendimento alle reti neurate di fisica e la condivisione dei dati collaborativi, fornisce agli ingegneri un ricco ecosistema di strumenti per costruire modelli efficaci anche quando i dati sono limitati.