Fondamenti della classificazione delle immagini satellitari

La classificazione delle immagini satellitari è un compito fondamentale nel rilevamento remoto che assegna etichette di copertura terrestre, come foresta, urbano, acqua e agricoltura, a ogni pixel o oggetto in un'immagine satellitare.

Le immagini satellitari sono registrate in più bande spettrali, visibili, quasi infrarate, a onde corte e termiche, ognuna delle quali cattura diverse proprietà dei materiali superficiali. I classificatori devono sfruttare queste firme spettrali, mentre la contabilità per il contesto spaziale, gli effetti atmosferici e le variazioni stagionali.

Algoritmi chiave per l'apprendimento delle immagini satellitari

Macchine vettoriali di supporto

Le macchine vettoriali (SVM) sono modelli di apprendimento supervisionati che trovano le classi di separazione iperplane ottimali in uno spazio ad alta dimensione.Per le immagini satellitari, lo spazio delle caratteristiche è spesso costituito da valori di banda spettrale, indici di vegetazione o misure di texture. L'algoritmo SVM identifica i vettori di supporto, tracciando campioni più vicini al limite di decisione, e li utilizza per massimizzare il margine tra le classi.

Foresta casuale

La Foresta Random è un metodo di campionamento basato su molti alberi di decisione, ognuno formato su un sottoinsieme di scarponi e su un sottoinsieme casuale di caratteristiche. Durante la classificazione, ogni albero vota per una classe e la decisione di maggioranza è presa. Questo approccio di riduzione di varianza riduce il sovraccarico rispetto a un singolo algoritmo di decisione e fornisce risultati di importanza caratteristica incorporata che aiutano a interpretare quali bande spettrali o indici di vegetazione contribuiscono più alla separazione robusta.

Reti neurali profonde (Reti neurali convoluzionali)

I pixel di configurazione (CNN) sono diventati l'impronta di livello per la classificazione delle immagini satellitari, specialmente quando i modelli di contesto e di texture sono critici.

K‐Nearest vicini

K‐Nearest Nears (KNN) è un apprendista non-parametrico, basato su istanze che classifica un pixel per maggioranza tra i suoi campioni di formazione più vicini k nello spazio di funzionalità.

Vantaggi dell'apprendimento della macchina sopra i metodi tradizionali

  • Maggiore precisione nei paesaggi complessi:[] I metodi tradizionali assumono distribuzioni gaussiane o separazione lineare, mentre gli algoritmi di machine learning catturano relazioni non lineari, multimodali comuni nelle immagini satellitari del mondo reale. Ad esempio, la foresta casuale e le CNN producono abitualmente accurazioni complessive superiori al 90% sui set di dati di riferimento, superando i classificatori di probabilità massima di punti di 10–20.
  • Automazione dell'ingegneria delle caratteristiche:[[ I modelli di deep learning imparano le caratteristiche spaziali e spettrali end-to-end, riducendo lo sforzo manuale necessario per progettare indici artigianali o filtri della texture, riducendo così la barriera per i non esperti per produrre mappe di alta qualità.
  • Scalabilità ai volumi di dati di grandi dimensioni:[ Le tubazioni di apprendimento automatico possono elaborare terabyte di dati satellitari in parallelo utilizzando framework di calcolo distribuiti. Questa scalabilità è essenziale per generare prodotti globali di copertura del suolo ad alta risoluzione spatiotemporale.
  • Adattibilità e miglioramento continuo:[ I modelli possono essere riqualificati come nuovi dati di indagine sul campo diventano disponibili, consentendo l'aggiornamento continuo delle mappe di classificazione.

Sfide e limitazioni

Requisiti di dati e costi di etichettatura

Per le immagini satellitari, i dati di verità di terra provengono tipicamente da indagini sul campo, immagini ad alta risoluzione o mappe esistenti. L'acquisizione di tali etichette per diverse regioni geografiche e fasi fenologiche è costoso e richiede tempo.

Richieste computazionali

Le reti neurali profonde, in particolare, richiedono potenti GPU e grande memoria per la formazione su piastrelle multi-spettrali ad alta risoluzione. I servizi basati su cloud come Google Earth Engine e Amazon SageMaker offrono una computazione scalabile, ma i costi possono essere sostanziali per i progetti su larga scala.

Sovraccarico e Generalizzazione

I modelli di apprendimento automatico possono essere adattati a dati di formazione, soprattutto quando il set di dati è piccolo o squilibrio. Le tecniche di regolarizzazione (dropout, decadimento del peso, arresto precoce) e l'aiuto di validazione trasversale, ma il trasferimento di un modello formato in una regione all'altra con diverse caratteristiche di copertura del terreno spesso degrada le prestazioni.

Modello Interpretibilità

Modelli complessi come reti neurali profonde funzionano come “scatole nere”, rendendo difficile capire perché un particolare pixel è stato classificato come, diciamo, foresta al posto della terra arbustiva.

Direzioni e tendenze emergenti

L'integrazione di sistemi di apprendimento profondo e di classificazione delle immagini satellitari continua ad evolversi rapidamente. I meccanismi di attenzione e le architetture dei trasformatori, originariamente sviluppate per l'elaborazione di linguaggio naturale, sono adattati per catturare dipendenze spaziali a lungo raggio nelle immagini satellitari, superando le CNN su determinate attività di segmentazione.

Conclusioni

Gli algoritmi di apprendimento automatico hanno trasformato la classificazione delle immagini satellitari da un esercizio manuale, statistico in un processo automatizzato e ad alta precisione in grado di gestire flussi di dati di massa. Supporta macchine di risalto, foresta casuale, reti neurali profonde, e anche metodi più semplici come K‐Nearest Quartiere offrono punti di forza specifici per diverse applicazioni, con un apprendimento profondo che ora conduce alla frontiera.