基因组学、转录组学与系统生物学

单细胞测序(single-cell sequencing)

想象你想了解一座城市的情绪,办法却是把每个人的日记混成一本去读它的平均值。你会读出那句典型的话,却失去了每一个独特的声音——上夜班的护士、蹒跚学步的孩子、街头的抗议者。对组织做的混样测序正是这样取平均:它把成千上万个细胞一起磨碎,报告它们汇集在一起的 DNA 或 RNA。单细胞测序则把每个细胞分开来读,于是那些独特的声音又回来了。

最常见的形式——单细胞 RNA 测序——一次测量一个细胞里哪些基因被开启。窍门是把细胞在物理上分开——常常是把每个细胞困在它自己那一小滴油里——并在把所有东西汇到一起测序之前,给每个细胞的 RNA 贴上一个独特的分子条形码。之后,这些条形码让计算机把混在一起的读段重新分回它各自来源的细胞。结果是一张巨大的表格:一条轴上排着成千上万个细胞,另一条轴上排着成千上万个基因,每个格子大致是那个基因在那个细胞里表达了多少。在此基础上,软件按表达模式给细胞分组,揭示出藏在一块组织里那些不同的细胞类型和状态。

这通过暴露平均所掩盖的东西而改变了生物学:稀有的细胞类型、一个细胞在成熟过程中所走的轨迹,以及那些在显微镜下看上去一模一样的细胞之间出人意料的差异。它驱动着人类细胞图谱(Human Cell Atlas)这样的项目。但这些数据很难处理、也容易被过度解读——单个细胞产出的 RNA 又少又嘈杂,所以许多基因读出来是零,仅仅是因为它们被漏掉了(即“丢失”,dropout),而不是因为它们沉默。它产出的聚类和“细胞类型”是需要仔细解读的统计分组,而且这项技术通常会毁掉细胞,给出的是一张快照,而不是一部影片。

对一个肿瘤做混样测序只报告一个平均化的图谱,但对同一个肿瘤做单细胞测序却揭示它是一块拼图——有些细胞已经对某种药物耐受、有些还没有——这解释了为什么这种癌症能在治疗中存活下来。

单细胞方法找回了混样平均所抹平的那些个体声音。

在单个细胞里某基因读数为零,往往意味着它被漏掉了(丢失),而不是沉默。它找出的“细胞类型”是统计聚类,需要谨慎的生物学解读。

又称
single-cell RNA-seqscRNA-seq单细胞RNA测序單細胞RNA定序