Table of Contents
Dal momento che l'alba della ricerca genomica, gli scienziati hanno cercato di capire il macchinario intricato della vita a livello più fondamentale. Per decenni, l'approccio standard era quello di sequenza o profilato campioni di tessuto ingombrante, mescolando migliaia o milioni di cellule per estrarre un segnale medio. Ma la media oscura la notevole diversità che esiste tra le singole cellule all'interno dello stesso tessuto.
Cos'è la Genomica single-Cell?
La genomica monocellulare è una suite di metodi sperimentali e computazionali progettati per isolare e analizzare il materiale genetico – DNA, RNA, o chromatin – dalle singole cellule. A differenza della sequenziamento in massa, che produce una misura dell'insieme che riflette la media di tutte le cellule in un campione, approcci monocellulari catturano l'eterogeneità delle popolazioni cellulari.
Il termine "genomics" in genomica monocellulare originariamente riferito principalmente alla sequenziazione del DNA - variazione del numero di copia, varianti mononucleotide e varianti strutturali in singole cellule - ma ha ampliato per contenere il transcriptomics (scRNA-seq), epigenomics (scATAC-seq dettagliato, scHi-C), proteomics (CITE-seq), e multi-conotermi
Perché le risoluzione Single-Cell
L'importanza della risoluzione a singola cella è forse meglio illustrata dall'analogia: immaginate di cercare di capire una sinfonia registrando il suono medio dell'intera orchestra. Si perderebbe i contributi distinti di violini, violoncelli e percussioni. Analogamente, la media genomica ingombrante di migliaia di cellule, mascherando le differenze sottili ma critiche che definiscono i tipi di cellule, gli stati e le risposte.
Migliatoni storici e innovazioni tecnologiche
Il viaggio verso l'analisi monocellulare di routine è iniziato negli anni '90 con studi pionieristici che isolavano manualmente le singole cellule utilizzando micropipetti e hanno eseguito l'amplificazione basata su PCR di geni specifici. La vera rivoluzione è arrivata nel 2009 con il primo sequenziamento transcriptome a singola cella (Tang et al., Nature Methods), che ha dimostrato che è stato possibile ottenere profili di espressione genoma-wide da una singola cellula.
Piattaforme basate su microfluidici e gocciola
I dispositivi che controllavano i volumi di fluidi in piccoli canali hanno permesso ai ricercatori di isolare le singole cellule in gocce di nanolitro, ognuna delle quali funziona come un contenitore di reazione miniatura. L'introduzione del sistema Fluidigm C1 nel 2012 ha offerto la cattura automatizzata e l'elaborazione di fino a 96 celle, ma è stato lo sviluppo di metodi basati su goccia come Drop-seq (2015) e la piattaforma commerciale 10x Genomics scala Chro scale
Alternative basate su piatti e ad alto rendimento
Mentre i metodi basati su goccia dominano la trascrizione, gli approcci basati su piastre (ad esempio, Smart-seq2) offrono vantaggi per alcune applicazioni. Smart-seq2 fornisce una copertura di trascrizione integrale, facilitando il rilevamento di varianti di giunzione e varianti di sequenza, anche se a costi più elevati per cella e throughput inferiore.
Multi-Omics e Co-Profiling a singolo cellulare
Una delle innovazioni contemporanee più interessanti è la capacità di misurare simultaneamente più strati molecolari dalla stessa singola cellula. Tecnologie come CITE-seq (Cellular Indexing of Transcriptomes and Epitopes) combinano scRNA-seq con oligonucleotide-conjugated anticorpo-rilevamento proteina basato, fornendo dati trascrittivi e di superficie.
Sfide computazionali e innovazioni analitiche
L'esplosione di dati a singola cellula, spesso costituiti da milioni di cellule e migliaia di geni per cellula, ha richiesto una rivoluzione parallela nella biologia computazionale. Un esperimento tipico scRNA-seq può generare decine di gigabyte di dati di sequenziamento grezzo che devono essere demultiplex, allineati e quantificati.
Normalizzazione e correzione delle bacche
I dati a singola cella soffrono di alti tassi di abbandono (generi che vengono espressi ma non rilevati), di amplificazione e di effetti in batch dovuti a variazioni delle condizioni sperimentali.
Annotazione di tipo Clustering e Cell
Identificare popolazioni cellulari distinte implica in genere riduzione della dimensionalità (PCA, t-SNE, UMAP) seguita da clustering basato sui grafi (ad esempio, algoritmi Louvain o Leiden), tuttavia l'annotazione del tipo di cella coerente e accurata rimane un collo di bottiglia.
Inferenza traiettoria e RNA VelocitÃ
Oltre alle istantanee statiche, la genomica a singola cellula può catturare processi dinamici come la differenziazione o la risposta agli stimoli. I metodi di inferenza traiettoria (Monocle, Slingshot, PAGA) le cellule di ordine lungo un asse pseudo-tempo basato sulla somiglianza transcriptional, rivelando i cambiamenti di espressione geni continui durante le transizioni cellulari.
Integrazione transcriptomica spaziale
Forse la frontiera più emozionante nella genomica computazionale a singola cella è l'integrazione delle informazioni spaziali. Mentre scRNA-seq standard distrugge il contesto del tessuto, i metodi di trascrizione spaziale (come Visium e MERFISH) conservano le informazioni posizionali.
Impatto sulla ricerca biologica e sulle applicazioni cliniche
La genomica monocellulare ha già trasformato la nostra comprensione dello sviluppo, dell'immunologia e della biologia del cancro.
Cancro Eterogeneità e Clonal Evolution
Il DNA monocellulare che sequenzia la rivela l'architettura clonale dei tumori, identificando i sottocloni con le mutazioni del driver distinte e le alterazioni del numero di copia che possono sorgere sotto pressione del trattamento.
Biologia delle cellule di sviluppo e di stem
La genomica monocellula ha fornito una visione senza precedenti dell'embriogenesi e dell'organiogenesi. Attraverso la profilazione delle cellule da organismi di modello a più punti di tempo di sviluppo, i ricercatori hanno ricostruito le traiettorie di lignaggio da zigote a tipi di cellule specializzate.
Immunologia e Malattie Infettive
Il sistema immunitario è definito dalla diversità cellulare, dalle cellule T ingenue alle cellule TLT esausti, dalle cellule B della memoria e dalle cellule soppressive del mioloide. Il profilazione della trascrizione di singole cellule di sangue delle cellule mononucleari periferiche (PBMC) da donatori sani ha catalogato centinaia di sottoinsiemi di cellule, definiti da schemi di espressione unici.
Neuroscienze e l'Atlante per le Cellule del Cervello
La straordinaria complessità del cervello lo ha reso un obiettivo primario per la genomica monocellulare. L'Iniziativa BRAIN e l'Istituto Allen hanno spearheaded sforzi per creare una tassonomia globale del cervello mammifero. Singolo-nucleus RNA-seq (snRNA-seq) da cellule cerebrali umane congelate ha identificato decine di sottotipi corticali neuroni, classi di internaurone GABAergico: 1
Limitazioni attuali e sfide tecniche
In primo luogo, il costo per cellula è sceso drammaticamente ma rimane non banale per grandi studi di coorte. Un tipico 10x Genomics esperimento con 10.000 cellule può costare diversi migliaia di dollari, e la profilazione di milioni di celle da centinaia di campioni di pazienti è ancora costoso.
Le direzioni future: Le prossime frontiere
La traiettoria della genomica a singola cellula punta verso l'integrazione sempre maggiore, la risoluzione spaziale e le dinamiche temporali.
Genomica spaziale e transcriptomics
Mentre i metodi attuali di singola cellula distruggono l'architettura dei tessuti, la trascrizione spaziale preserva la posizione fisica delle cellule all'interno del loro ambiente nativo. Tecniche come MERFISH, seqFISH+, e Slide-seqV2 ottengono la risoluzione subcellulare mediante l'imaging trascrizioni codificate a barre direttamente nelle sezioni dei tessuti.
Epigenomica a singolo contatto e dinamica cromatina
La comprensione della regolamentazione del gene richiede l'accessibilità della cromatina, le modifiche istoniche e l'organizzazione del genoma tridimensionale a risoluzione di singole cellule. Tecnologie come scATAC-seq (saggio a singola cella per la cromatina causale-accessibile) e scHi-C (single-cell Hi-C) sono ancora nella loro infanzia, ma hanno già rivelato che gli stati cromatici variano tra i tipi di cellule e anche all'interno di una cellula.
Genomics in tempo reale e in tempo reale
Un obiettivo a lungo termine è quello di osservare i processi genomici, la scrittura, la replica, la riparazione, in tempo reale all'interno delle cellule viventi. Nuovi approcci utilizzando l'imaging a celle viventi di reporter fluorescenti combinati con l'imaging basato su CRISPR (ad esempio, Casilio, dCas9-EGFP) possono monitorare le dinamiche di loci genomiche.
Multi-Omics e apprendimento automatico
L'integrazione di più strati omici monocellulari diventerà più routine, con piattaforme come TEA-seq (transcriptome, epitopes, e accessibilità) e DOGMA-seq (DNA accessibilità più mRNA dalla stessa cella) che entrano in uso diffuso. L'apprendimento automatico, soprattutto l'apprendimento profondo, sta giocando un ruolo sempre più centrale nel trattamento di questi dataset ad alta dimensione.
Conclusioni
L'analisi genomica a singolo celle ha rivoluzionato la biologia rivelando la diversità nascosta degli stati e delle dinamiche che mancano i metodi di massa. Dall'individuazione dei tipi di cellule rare nello sviluppo alla diffusione dell'evoluzione clonale nei tipi di cellule tumorali e mappando i tipi di cellule cerebrali in malattia neurologica, l'impatto è stato profondo e sempre più esteso.