发布时间:2014-10-27 10:55 原文链接: 第三代测序技术:PacBio单分子测序最新科研动态

  DNA基因测序技术从上世纪70年代起,历经三代技术后,目前已发展成为一项相对成熟的生物产业。测序技术的应用也扩展到了生物、医学、制药、健康、农林、园艺、花卉、环保、法医等许多领域,并成为一项与我们衣食住行密切相关的高技术产业。据最新统计,2012年全球基因测序市场的产值已超过百亿,按最近几年增长速度,预计2017年市场产值将加倍。因此可以说,基因测序在我国生物科技领域具有非常重要的战略意义。

  “第三代测序技术”的研发已有近十年时间,商业化的第三代测序仪上市也有三年。目前,国内对Pacbio单分子测序研究也有了最新进展:

  NO.1 中科院药植所采用PacBio单分子测序揭示丹参叶绿体DNA修饰之间复杂的相互作用:编码及非编码RNA的表达

  2014年6月10日,中科院药用植物研究所(IMPLAD)刘昶团队在《PLOS ONE》杂志上发表了利用PacBio测序技术揭示丹参(Salvia miltiorrhiza)叶绿体DNA修饰之间复杂相互作用的相关文章,该文章报道了丹参叶绿体中编码及非编码RNA的表达情况。这也是国内PacBio第三代测序用户在国际性杂志发表的第一篇文章。

  丹参是最广泛使用的药用植物之一。作为基于叶绿体基因工程手段开发使丹参活性成分过表达方法的第一步,该研究团队从基因组,转录组,和碱基修饰三方面对丹参叶绿体进行了分析。先从新鲜叶片中提取总基因组DNA和RNA,然后进行链特异性RNA测序和PacBio公司的单分子实时(Single-Molecule Real-Time, SMRT)测序分析。

  实验先是将RNA测序得到的reads mapping到基因组,使该研究小组确定了80个蛋白质编码基因的相对表达水平。此外,还明确了19个多顺反子转录单元和136个假定反义和基因间非编码RNA(ncRNA)基因。将蛋白编码基因的转录本(cRNA)丰度与重叠反义非编码RNA(asRNA)相比较表明,asRNA的存在与cRNA的丰度增加有关(P<0.05)。使用SMRT Portal软件预测到了2687个潜在的DNA修饰位点和2个潜在的DNA修饰基序。两个基序包括TATA盒样基序(CPGDMM1, ''TATANNNATNA''),以及一个未知的基序(CPGDMM2, ''WNYANTGAW'')。

  研究采用二代和三代DNA测序技术并用,使在基因组层面研究非编码RNA和DNA修饰成为可能。然而,原来关于反义RNA和DNA修饰研究在实验上具有相当大的困难。首先,大多数asRNA转录本表达水平显著偏低,因而难以用经典技术如Northern Blot和原位杂交进行验证。第二,正义和反义转录本之间错综复杂的关系意味着实验扰动会不可避免地干扰其他转录本的表达。因此,通过knocking-in和knocking-out技术确定转录本的生物学功能是复杂的。第三,虽然SMRT技术已被证明能够检测到潜在的DNA修饰,但验证这些修饰仍然是个挑战性的任务。第四,叶绿体asRNA和DNA修饰的存在和功能的验证是更加困难的。

  综上所述,本研究所描述的一些发现从目前的技术上来讲是有巨大进步的。然而,本研究提出的数据已经证实了由asRNA和DNA修饰引起的基因表达调控的复杂性。

  NO.2 三代基因测序组装算法和软件研发获突破

  “第三代测序技术”的研发已有近十年时间,商业化的第三代测序仪上市也有三年。但目前测序市场仍为二代测序技术所垄断(我国顶级科研机构和商业公司所拥有的三代测序仪可能仅有数十台)。三代测序技术产生的读段更长,测序成本更低,其取代二代技术是测序技术发展的必然趋势。然而由于三代测序技术错误率高,现有的组装软件多是对第二代测序数据组装软件的“修补”而并没有充分考虑到三代测序技术的数据特征。事实上,基因组装算法问题被广泛认为是计算生物学和生物信息学领域最复杂的计算难题之一,也是目前阻碍基因测序产业从二代技术升级到三代技术最大的技术障碍。

  最近,美国马里兰大学 Chengxi Ye, James A. Yorke, Aleksey Zimin 等与中国科学院昆明动物研究所遗传资源与进化国家重点实验室马占山研究员在这一领域的合作研发取得新突破。该研究团队在一篇题为DBG2OLC: Efficient Assembly of Large Genomes Using the Compressed Overlap Graph 的文章中引入了一种新的针对三代测序技术的基因组装算法,并开发出一款软件(DBG2OLC)。另外作者(Ye et al. 2011, 2012)于2011年发布的SparseAssembler曾经比当时主流的基因组装软件节省90%的内存空间,而其计算时间和组装质量却毫不逊色。著名的SOAPdenovo的升级版,也是目前最广泛应用的基因组装软件SOAPdenovo2即采用了SparseAssembler算法。

  多组测序数据的测试表明:与目前用于三代测序最优秀的一些基因组装软件(例如PacBio2CA, HGAP, ECTools)相比,DBG2OLC在计算时间和内存空间的消耗通常仅为其它算法的1/10。理论上,DBG2OLC 在时间和空间的使用上相对其它同类软件可减少达1000倍。例如组装关键步骤之一的“两两比对”计算,采用一组由 PacBio提供的人类基因组数据,DBG2OLC 使用一台普通PC仅用了6小时完成。而同样计算,Pacific Biosciences所报道的时间为 405000 CPU小时,而且是在Google的计算集群上完成。因此,DBG2OLC 算法基本解决了目前三代测序技术所面临的计算技术挑战,从而为推进基因测序技术的产业升级奠定了良好的技术基础。

  NO.3 PacBio RS II 测序系统原理

  PacBio RS测序仪系统能够对单个DNA(脱氧核糖核酸)分子进行测序,而目前市场上的主流测序仪只能对分子群体进行平均测序。单分子测序能对DNA中罕见的序列变异进行分析,也不需要在测序之前对DNA样本进行放大,因为放大过程可能引发错误,导致对某个DNA序列检测失败。其工作原理是用一种聚合酶将DNA的复制限制在一个微小的间隙中,给各种碱基加上荧光示踪标记,当碱基合成DNA链时,这些荧光标记就会发出不同颜色的闪光,根据闪光颜色就可识别出不同的碱基。

  NO.4 PacBio RS II 测序系统特点

  1、测序读长长:平均测序读长能达到3,000至5,000碱基,最长的序列能达到20,000碱基;

  2、准确率高:对基因组组装和基因组变异检测,可以最多达到99.999%的准确率;选用特殊测序模式,测序准确率可以在达到单个分子99%准确率的条件下,读长超过经典的Sanger测序法;

  3、极度的敏感性:可以检测频率在0.1%的 minor variants;

  4、直接检测广泛的碱基修饰:除了5-methylcytosine修饰以外, 还可以检测N6-methyladenine, N4-methylcytosine, DNA氧化损伤以及其它碱基的修饰;

  5、GC偏向性(GC bias)小:在极端高GC和极端低GC区域,可以轻松测定,从而保证序列的均匀覆盖度;

  6、无PCR扩增偏向性:样本不需要进行PCR扩增,避免了覆盖度不均一和PCR artifacts。

相关文章

厚积薄发我国科学家揭开表观遗传“神秘面纱”

长期以来,人们普遍认为,脱氧核糖核酸(DNA)决定了生物体的全部表型。但问题来了,在相同环境中成长的同卵双胞胎,身高、肤色、性格、健康状况等并非完全相同,这是为什么?为了揭开表观遗传的“神秘面纱”,科......

基因解码揭示人类无尾之谜

纽约大学格罗斯曼医学院(NYUGrossmanSchoolofMedicine)的研究人员进行的一项新研究表明,我们远古祖先的基因变化可以部分解释为什么人类不像猴子那样有尾巴。这项研究成果最近发表在《......

人与猿类如何在进化中“甩掉”尾巴

猴子有尾巴,而人类和猿类的尾巴却在进化中消失了,是什么在其中起了关键作用?《自然》28日发表的一篇论文,报道了人类和猿类演化掉尾巴的遗传学基础。灵长类动物尾部表型的系统发育树(Ma表示百万年前)。图片......

一步到位沉默一个小鼠胆固醇基因

意大利科学家在一项小鼠研究中展示了无需永久性基因组编辑,也可对一个控制胆固醇水平的基因做到长效抑制。这一靶向表观遗传沉默(不用直接改变DNA序列就可改变基因功能)的效果在小鼠中持续近1年,令循环胆固醇......

安捷伦一季度营收缩水5.6%,仍稳坐16.6亿美元大关

2月27日,安捷伦科技公司(纽约证券交易所代码:A)公布截至2024年1月31日的2024财年第一季度财报。第一季度营收为16.6亿美元,与2023年第一季度相比下降5.6%,核心营收(1)下降6.4......

多样化菌群共存现象有了新解释

近日,中国科学院深圳先进技术研究院合成生物学研究所副研究员王腾团队在《自然—通讯》发表研究成果。该研究从理论上揭示了微生物群落中广泛存在的水平基因流动可以帮助竞争性微生物群体突破物种多样性“极限”,促......

年度盘点:2023年阿尔茨海默病研究初现曙光

阿尔茨海默病(AD)又称老年痴呆,起病隐匿,病程缓慢且不可逆,以智能障碍为主。随着人口老龄化的进展,全球AD患者数量逐年增加,严重危害中老年人的健康,也给家庭和社会带来沉重的负担。回望2023年,AD......

与DNA损伤相关的145个基因“现形”

研究示意图。图片来源:《自然》杂志据最新一期《自然》杂志报道,通过对近1000只转基因小鼠开展研究,英国科学家发现了100多个与DNA损伤有关的关键基因。这项研究为开发癌症和神经退行性疾病个性化疗法提......

关节炎滑膜组织基因表达调控图谱,揭示关节炎风险位点的功能特征

关节炎是一种常见的关节病变,主要表现为滑膜增生、软骨变性及软骨下骨增生,造成关节功能丧失和生活质量下降,在60岁以上人群发病率超过50%,全球范围内有数亿人受到影响。全基因组关联研究(Genome-w......

直接面向消费者的基因检测市场规模、趋势、2032年报告

2022年,全球直接面向消费者的基因检测市场规模为17.2亿美元,预计到2032年将达到76亿美元左右,2023年至2032年复合年增长率为16.10%。市场概况直接面向消费者的基因检测市场是一个快速......