基因组学最近的进展极大地扩大了我们对基因变异如何推动健康、疾病和药物反应的认识。 人类基因组蕴藏着数百万变异体,但绝大多数在功能后果方面仍然不具有特征。 研究单个变异体的传统方法——如由地点指导的突变,然后是低通量分析 — 过于缓慢和昂贵,无法满足现代基因组学的需求。 高通量功能筛选(HTFS)已经成为一种变革性解决方案,使得在单一实验中能够同时对数千至数百万变异体进行功能评估。 这种方法正在加速对变异体功能进行注释,从基因组全协会研究中找出因果变异体,并指导个人医学的临床解释。

高功能筛选介绍

高通量功能筛选是指一套实验方法,系统地测试众多基因改变对可测量的生物读取的影响. 核心原则是建立大型变异序列库,引入相关的细胞模型,然后根据兴趣的苯基类型(如基因表达,细胞健身,蛋白质活动)对细胞进行分类或测量. DNA合成,测序和自动化的进步使得在几周内设计,构建和测试包含数万个变异的库成为可能,这些方法对于解释大规模测序项目发现的大量变异,尤其是那些被归类为不确定意义的变异(VUS)至关重要.

推动高强度筛选的核心技术

几种强大的技术支撑着现代的HTFS,每种技术都有自己的优势和应用.

基于 CRISPR 的屏幕

CRISPR-Cas9技术通过能够以可扩展的方式进行精确基因组编辑,使功能基因组学发生了革命性的变化。在典型的集合式CRISPR屏幕中,针对数千个基因组学地点的单导RNA(sgRNA)库被送入细胞中,用Cas9. 由此产生的编辑-插入、删除或点突变-允许研究人员评估功能丧失(CRISPR淘汰、CRISPRko)、激活(CRISPRA)或压制(CRISPRi)对苯基型的影响。 更先进的变体,如基编辑和主编辑,能够精确地引入特定点突变,从而能够筛选已知的疾病相关变体的影响,或者系统地绘制蛋白质或调控元素中的功能残基。

大规模平行报道者分析

MPRA是检验数千种调控变体对基因表达的影响的选择方法。在一个典型的MPRA中,DNA序列库(每个都包含一个兴趣变体)被克隆在最小促进器和报告器基因(如GFP,luciferase,或条码)的上游。 库被引入细胞,通过测序将记者RNA或蛋白质的丰度量化。通过将输出与输入库进行比较,研究人员可以衡量每个变体如何改变转录活动。 MPRAs被用于系统评价GWAS风险变体,识别功能上的非编码变体,以及解析器和增强逻辑。

其他高强度办法

饱和突变与深测序(如深测突变扫描)相结合,可以对蛋白质域中每一个可能的单单氨基酸替代功能进行特征分析. 合成生物学工具,如调控序列的组合库,有助于发现突变,翻译,蛋白质稳定性的序列决定因素. 此外,基于报告人构造的高通量荧光活性细胞分拣(FACS)等技术,能够使细胞富集,产生预期的变异效果.

最近的创新和方法进展

外地正在迅速演变,采用新方法,增加分辨率,降低成本,并整合补充数据类型。

与单字符序列合并

最新最令人兴奋的发展之一是将集合屏幕与单细胞读数(如Perturb-seq、CROP-seq)结合。 这些方法不是测量大宗人口平均值,而是捕捉扰动后单个细胞的累记、蛋白质或直观特征。 这揭示了细胞的特异性效应、变异影响和基因变化的多地球效应。 单细胞分辨率对于研究发育过程、免疫反应和癌症演化,而人口平均数可以掩盖重要亚人群,是特别宝贵的。

用于变异排列顺序的机器学习

机器学习算法现在是HTFS工作流程的组成部分。它们通过预测哪些变异最有可能是功能性的(例如基于进化保存,蛋白质结构,或铬化物状态)来帮助设计变异库。 在筛选后,ML模型可以整合大规模数据集,将变异物归类为致病性或良性,优先确定验证对象,并推断基础机制。 深层学习架构,如进化神经网络(CNN)和在大规模基因组数据集上训练的变异器,在预测功能效应时表现出了令人印象深刻的准确性,并且正在通过实验屏幕的持续反馈来完善。

多功能集成

将HTS与其他的动漫层(如蛋白质组学、元组学或外观基因组学)结合起来,可以更全面地了解变异功能,例如,将MPRA与铬化物无障碍检测(如ATAC-seq)结合,可以揭示监管变异是否影响以上下文为依归的方式绑定的转录因子,这种综合方法对于理解基因型和苯基之间的复杂相互作用至关重要。

研究和医学应用

HTFS已经在转变我们解释基因组变异的能力,并把它转化为临床实践.

对不确定意义的备选案文的功能性说明

临床基因组学的一个主要瓶颈是遗传测试中报告的VUS比例很高. HTFS可以系统评估数千VUS在遗传性紊乱相关基因中的功能影响,如BRCA1[,TP53,以及[CFTR. 这些屏幕通过提供功能证据,帮助将变体重新分类为良性或致病性,直接改善诊断产值和病人管理.

药原基因组学和药物开发

高通量屏幕可以识别改变药物反应的基因变体,从而预测不良反应或缺乏疗效。 在药物发现中,HTS被用于映射癌症靶基因的抗变,帮助设计下一代抑制剂。 此外,通过剖析药物靶点的全突变地貌,研究人员可以预测肿瘤如何演变抗变能力,并相应开发复方疗法。

了解疾病机制

筛选与疾病有关的细胞类型(如神经元、心肌细胞、免疫细胞)中的大型变异库,可以发现因果变异及其影响的途径。 例如,研究利用CRISPR屏幕来识别癌细胞中的基本基因,揭示新的治疗弱点。 在神经发育失调中,MPRA识别出在皮质发育过程中干扰基因调控的增强变异,提供了自闭症和精神分裂症等条件的机械化透视。

当前的限制和未来方向

尽管存在实力,但人的安全信托基金面临若干挑战,必须加以解决,才能发挥其潜力。

可扩展性和成本

DNA合成和测序的成本已经大幅下降,但大规模屏幕 — — 特别是那些需要定制细胞线、单细胞测序或复杂的间皮分析的屏幕 — — 仍然昂贵。 图书馆设计(如组合式合成 ) 、 自动化和小型化(如以滴水平台)的未来改进将降低成本,并实现这些技术的民主化。

生物复杂性和环境特性

变异效应可能高度依赖于细胞类型,遗传背景,环境,以及内生状态. 一种在一种情况下是良性的变异可能是另一种情况下的致病性. 3D基因组结构,突变调控,以及翻译后修改增加了复杂层,在简化模型系统中难以捕捉到. 有机物,共育,以及活体筛选(例如小鼠或斑马鱼使用CRISPR)的进步开始解决上下依赖性问题,但还有大量的工作有待完成.

数据分析和解释

高温热量数据——通常数十亿的测序数据——需要强有力的计算管道来进行质量控制、正常化和统计。必须认真管理由于目标外效应、图书馆偏差或结构噪声造成的假阳性数据。此外,将高温热量热量数据与其他基因组资源(例如[]、ENCODE[、ClinVar、gnomaD)整合起来,仍然是一项挑战。为使元数据标准化、开发共同数据模型和通过公共储存库共享结果(例如、ClinVar)的努力对于最大限度地发挥这些研究的影响至关重要。

结论

高通量功能筛选已经从一种专门技术转向现代基因组学的基石。 通过系统评估基因变异,这些方法正在加速发现功能元素,改善临床基因组学的变异解释,并给疾病生物学提供新的洞察力。 新兴技术如单细胞分辨率、机器学习融合和多基因组方法,都有望进一步加深我们对基因变异如何塑造人类健康的理解。 随着成本的降低和方法的普及,HTFS将成为研究人员和临床医生越来越重要的工具,有助于弥合基因型和苯基之间的鸿沟。

关于功能基因组技术的全面概述,见 Canver等人(2017年)在《自然遗传评论》中的评论. 关于变异解释的额外资源,可通过ClinVar数据库[NIH基因组测序方案找到。