En tirant parti des réseaux neuronaux artificiels à plusieurs couches, les scientifiques peuvent maintenant extraire des modèles significatifs d'enregistrements neuraux bruyants et à haute dimension avec une précision sans précédent. Cette synergie entre l'apprentissage profond et le traitement du signal neuronal accélère le développement d'interfaces cerveau-ordinateur, de prothèses neurales et d'outils de diagnostic qui étaient autrefois des objets de science-fiction. À mesure que le domaine mûrit, il est essentiel de comprendre le rôle de l'apprentissage profond dans le traitement du signal neuronal pour toute personne impliquée dans le génie neuronal, des étudiants des cycles supérieurs aux chercheurs chevronnés et aux professionnels de l'industrie.

Comprendre le traitement du signal neuronal : des données brutes aux données significatives

Le traitement des signaux neuraux est l'épine dorsale de l'ingénierie neuronale moderne, qui englobe les méthodes utilisées pour capturer, filtrer et interpréter l'activité électrique produite par les populations de neurones.Ces signaux se manifestent sous plusieurs formes, chacune avec sa propre résolution temporelle et spatiale : l'électroencéphalographie (EEG) enregistre l'activité au niveau du cuir chevelu, l'électrocorticographie (ECOG) nécessite des grilles d'électrodes subdurales et les enregistrements intracorticaux utilisent des réseaux de microélectrodes pour capter l'activité à une unité ou les potentiels locaux de terrain.

Caractéristiques clés des signaux neuraux:[

  • Haute dimensionnalité:[ Les tableaux d'enregistrement modernes peuvent capturer simultanément des centaines à des milliers de canaux, chacun produisant une série chronologique continue.
  • Ratio faible entre le signal et le bruit : Les signaux neuraux sont souvent contaminés par des artefacts biologiques (p. ex., clignements oculaires, activité musculaire) et par le bruit ambiant.
  • Non-stationnaire:[ Les propriétés statistiques des signaux neuraux changent au fil du temps en raison de la plasticité, de la fatigue ou des changements de l'état cognitif.
  • Sparsité et non-linéarité:[ De nombreux événements neuraux significatifs (p. ex., trains à pics) sont rares, et leur relation avec le comportement externe est intrinsèquement non linéaire.

Les approches traditionnelles, comme l'analyse des composantes principales, les transformations des vagues et les classificateurs linéaires, ont servi le terrain pendant des décennies, mais elles ont du mal à comprendre la complexité et l'ampleur des ensembles de données neurales modernes. Par exemple, les décodeurs linéaires peuvent ne pas saisir la dynamique complexe de l'activité de la population du cortex moteur pendant les mouvements naturels, et les analyses basées sur la fréquence rejettent souvent les informations de phase critiques pour la plasticité dépendante des pics.

Pour un aperçu complet des fondamentaux du traitement du signal neuronal, les chercheurs se tournent souvent vers le tutoriel sur le traitement du signal pour les enregistrements neuronaux publié par Frontiers en neuroscience.

L'élévation de l'apprentissage profond en génie neurologique

Contrairement aux modèles peu profonds qui nécessitent des caractéristiques artisanales, les réseaux profonds apprennent des représentations de plus en plus abstraites directement à partir de données. Un réseau neuronal convolutionnel (CNN) pourrait d'abord détecter les bords d'un spectrogramme, puis combiner ces bords en motifs rythmiques, et enfin associer ces motifs à une intention motrice spécifique. Les réseaux neuronaux récurrents (RNN), particulièrement les unités de mémoire à court terme (LSTM), excellent à modéliser les dépendances séquentielles dans les données de séries chronologiques comme les EEG ou les trains à pics.

L'adoption de l'apprentissage profond en génie neuronal a été accélérée par trois facteurs : l'explosion de données neuronales à grande échelle (par exemple, du Laboratoire international du cerveau), la disponibilité de puissants GPU et la maturation de cadres d'apprentissage profond à source ouverte.La recherche a montré que les réseaux profonds peuvent surpasser les méthodes traditionnelles dans des tâches allant de la classification des stades du sommeil au contrôle en temps réel des bras robotiques.Une étude de 2019 dans Nature Biomedical Engineering[ a démontré qu'un décodeur basé sur CNN pourrait atteindre une précision presque parfaite dans la prévision des mouvements d'écriture prévus de l'activité neuronale, un exploit qui avait échappé à des tentatives antérieures.

Pourquoi l'apprentissage profond fonctionne pour les signaux neuraux:

  • Apprentissage de bout en bout:[ Le réseau apprend l'ensemble du pipeline de l'entrée brute à la sortie, éliminant le besoin d'ingénierie manuelle des fonctionnalités.
  • Abstraction hérarchique :[ Les couches précoces capturent les caractéristiques de bas niveau (p. ex. formes de pics, pics spectraux); les couches plus profondes capturent les motifs de haut niveau (p. ex. intentions de mouvement, états cognitifs).
  • Route sonore:[ Avec des ensembles d'entraînement suffisamment volumineux, les réseaux profonds peuvent apprendre à ignorer les sources sonores non pertinentes.
  • Trafer learning:[ Les modèles pré-formés peuvent être adaptés à de petits ensembles de données spécifiques à un sujet, réduisant ainsi le besoin de nouveaux enregistrements.

Un examen faisant autorité de l'apprentissage profond des signaux neuraux se trouve dans le IEEE Signal Processing Magazine, qui explore les possibilités et les pièges.

Applications en génie neuronal

Interfaces cerveau-ordinateur (BCI)

Les interfaces cerveau-ordinateur forment l'application la plus visible de l'apprentissage profond en génie neuronal. Les BCI traduisent l'activité neuronale en commandes pour les appareils externes, offrant communication et contrôle aux personnes ayant de graves handicaps moteurs. Les BCI traditionnels reposent souvent sur des décodeurs linéaires ou l'extraction de fonctionnalités de base (p. ex., densité spectrale de puissance dans le rythme mu).

Pour imagerie moteur BCI[, où les utilisateurs imaginent déplacer un membre pour produire des modèles EEG distincts, les CNN avec plusieurs filtres temporels peuvent automatiquement apprendre les caractéristiques spectrales-spatiales qui différencient gauche de l'imagination de la main droite. Des architectures récentes telles que EEGNet et ShallowConvNet ont atteint l'exactitude la plus récente sur les repères publics, parfois plus de 90 % dans des tâches de deux classes.

Dans le domaine des ICB intracorstiques, l'apprentissage profond a permis un contrôle remarquablement naturel des membres prothétiques. Des réseaux neuronaux récurrents formés à l'activité de spiking du cortex moteur peuvent prédire des trajectoires de bras tridimensionnelles en temps réel, même pendant des mouvements auto-rapides non répétitifs. Une étude historique du consortium BrainGate a utilisé un décodeur LSTM pour obtenir une précision de 94 % dans les phrases de frappe neuronale à un taux comparable à celui du pouce corsé sur un smartphone.

Décodage et cartographie neuronaux

Au-delà du contrôle direct du BCI, l'apprentissage profond révolutionne la façon dont nous décodons les états cognitifs et mapons les réseaux fonctionnels du cerveau. Le décodage neuronal implique de déduire l'expérience perceptuelle, l'intention ou la charge cognitive d'un sujet de son activité cérébrale.Par exemple, des modèles générateurs profonds, comme les auto-encodeurs variables (VAE), peuvent reconstruire les stimuli visuels à partir d'enregistrements fMRI ou EcoG, «lire» efficacement ce qu'une personne voit.

La cartographie fonctionnelle[ vise à identifier les régions du cerveau qui sont impliquées dans des tâches ou des comportements spécifiques. L'apprentissage profond peut analyser les données de l'IRMf à l'état de repos pour découvrir des modèles de connectivité fonctionnelle reproductibles qui sont corrélés avec des affections psychiatriques comme la dépression ou la schizophrénie.

Prothèses neurales et systèmes en boucle fermée

Les implants cochléaires et les prothèses rétiniennes sont déjà des succès commerciaux, et l'apprentissage profond est en passe d'améliorer leurs performances. Dans les implants cochléaires, les modèles d'apprentissage profond peuvent adapter en temps réel les schémas de stimulation aux réponses neurales individuelles, améliorant la perception du son dans les environnements bruyants.

Les systèmes à boucle fermée utilisent des enregistrements neuronaux en temps réel pour moduler les paramètres de stimulation de façon adaptative. Les agents d'apprentissage en profondeur peuvent apprendre à ajuster les paramètres de stimulation cérébrale profonde (DBS) pour la maladie de Parkinson, en minimisant les effets secondaires tout en maximisant les bienfaits thérapeutiques.

Diagnostic de l'épilepsie et prévision de la saisie

Les CNN formés sur les spectrogrammes peuvent automatiquement détecter les rejets épileptiformes interictaux, réduisant ainsi considérablement le fardeau des examinateurs humains. Plus ambitieux, les modèles d'apprentissage profond peuvent prédire le début d'une crise de minutes à l'avance en apprenant les changements subtils de la dynamique cérébrale qui précèdent les événements cliniques.Une étude 2021 dans Epilepsia[ a indiqué qu'un modèle d'apprentissage profond basé sur l'attention pourrait prévoir des crises avec une sensibilité de 83 % et un taux faussement positif de seulement 0,16 par heure— performance qui approche la viabilité clinique.

Défis et atténuations

Malgré ces succès, l'apprentissage profond du traitement des signaux neuraux n'est pas sans obstacles. Les praticiens doivent naviguer sur les questions de rareté des données, de modélisation de l'interprétation, de coûts de calcul et de généralisation entre les sujets.

La rareté et l'augmentation des données

Les ensembles de données neurales sont notoirement petits, ne comptant souvent que quelques heures d'enregistrement d'une poignée de sujets. Les réseaux profonds nécessitent généralement des millions d'échantillons pour bien généraliser. Pour y remédier, les chercheurs utilisent des techniques d'augmentation des données[ qui élargissent artificiellement l'ensemble de formation sans nouveaux enregistrements. Les stratégies communes comprennent l'ajout de bruit gaussien, l'échange de canaux, les changements de temps et les changements de fréquence. L'apprentissage de transfert joue également un rôle critique : un réseau pré-entraînement sur un grand ensemble de données EEG public (p. ex., le CHB-MIT de PhysioNet) peut être perfectionné sur une tâche spécifique avec aussi peu que 20 minutes de données. L'apprentissage semi-supervisé exploite de grandes quantités de données non marquées pour pré-former un modèle, qui est ensuite affiné avec un petit ensemble de données étiqueté.

Interprétabilité et confiance

Plusieurs techniques ont été mises en évidence pour éclairer ces modèles : des cartes de tolérance mettent en évidence les points de temps ou les bandes de fréquences qui influencent le plus une prédiction; une propagation de pertinence par couche trace la décision de retour à l'entrée; [des gradients intégrés[ attribuent la sortie à des caractéristiques individuelles. Par exemple, une carte de tolérance d'un CNN formé à la détection des saisies peut révéler que le modèle repose sur les mêmes oscillations de haute fréquence que les cliniciens identifient manuellement, ce qui donne confiance dans sa plausibilité biologique.

Demandes de calcul et contraintes en temps réel

De nombreuses applications de génie neuronal nécessitent un traitement en temps réel avec une latence minimale. La formation de modèles profonds est intensive par calcul, mais l'inférence peut souvent être optimisée. Des techniques telles que la taille (en supprimant les connexions inutiles), [quantisation (en utilisant l'arithmétique de moindre précision), et distillement[ (formation d'un réseau d'étudiants plus petit pour imiter un plus grand «enseignant») peuvent réduire la taille du modèle et accélérer l'inférence par ordre de grandeur.

Généralisation sur les sujets et les séances

L'un des défis les plus difficiles est que les signaux neuraux varient considérablement d'un individu à l'autre et même d'une session d'enregistrement à l'autre en raison des changements d'impédance, de la fatigue ou de l'attention qui se déplace. Les modèles d'apprentissage profond formés sur un sujet échouent souvent sur un autre.Les techniques d'adaptation de domaine, comme la formation contradictoire et la réduction des écarts, peuvent aligner la distribution des fonctions entre les sujets sans exiger de données marquées du sujet cible. Le apprentissage profond de Bayesian fournit des estimations d'incertitude, permettant à un BCI de peser ses extrants et de s'abstenir lorsqu'il est incertain – un élément de sécurité critique pour les dispositifs médicaux.

Orientations futures

Le domaine évolue rapidement et plusieurs pistes de recherche prometteuses sont en passe d'approfondir le rôle de l'apprentissage profond dans le traitement des signaux neuraux.

Intégration multimodale et à échelles multiples

Les futures interfaces neuronales combineront des signaux provenant de multiples modalités (EEG, fMRI, fNIRS, et même des marqueurs moléculaires) pour créer une image plus complète de l'état du cerveau. Les modèles d'apprentissage profond (par exemple, les autoencodeurs variables multimodales) peuvent fusionner ces flux de données hétérogènes, permettant ainsi un décodage plus riche et des cartographies plus robustes.

Apprentissage autosupervisé et contrastif

Inspiré par les succès du traitement naturel du langage, les méthodes d'apprentissage autosupervisées qui exploitent la structure temporelle des signaux neuraux émergent. Le codage prédictif contrastif (CPC) apprend les représentations en prédisant les futurs segments de l'activité neuronale du contexte passé, sans avoir besoin d'étiquettes.Ces représentations pré-formées peuvent ensuite être ajustées pour toute tâche en aval – du décodage moteur au somnifère – avec très peu d'exemples marqués.Cette approche promet de débloquer la valeur des grandes quantités de données neurales recueillies quotidiennement dans des milieux de recherche et cliniques.

Considérations éthiques et réglementaires

Les données neurales sont uniques en leur genre, elles peuvent révéler non seulement des intentions motrices, mais aussi des émotions, des souvenirs et même des biais subconscients. Des cadres de protection de la vie privée différentiels peuvent protéger les données individuelles tout en permettant la formation de modèles, et des défenses contradictoires peuvent prévenir les attaques malveillantes contre les IBC. Des organismes de réglementation comme la FDA élaborent des cadres pour les dispositifs médicaux compatibles avec l'IA/ML, exigeant la transparence dans la validation des algorithmes et la surveillance des performances réelles.

Conclusion

L'apprentissage profond a transformé de façon irrévocable le traitement du signal neuronal, en élevant le champ de l'extraction manuelle des caractéristiques et des décodeurs linéaires à un décodage neuronal en temps réel qui rivalise avec les performances humaines dans des tâches spécifiques. De la capacité des personnes paralysées à communiquer à des vitesses de parole naturelles à la prédiction des crises épileptiques minutes à l'avance, l'impact pratique est tangible et croissant.

L'avenir promet des interfaces neuronales multimodales, des modèles auto-supervisés qui apprennent à partir de données non marquées et le déploiement éthique de ces outils dans les soins cliniques. Les chercheurs et les praticiens qui investissent dans la compréhension des principes et des limites de l'apprentissage profond seront mieux placés pour conduire la prochaine vague de neurotechnologie.