[导读]基因测序,一直就是科学家不断地孜孜追求破译生命遗传信息的关键方法,而其海量、复杂、多变的数据计算需求一直是横越在前行道路上的一道鸿沟。随着多年来超级计算机的不断发展,高性能计算在基因测序发展上发挥了重
基因测序,一直就是科学家不断地孜孜追求破译生命遗传信息的关键方法,而其海量、复杂、多变的数据计算需求一直是横越在前行道路上的一道鸿沟。随着多年来超级计算机的不断发展,高性能计算在基因测序发展上发挥了重大的助推作用。而作为中国首屈一指且世界知名的基因研究机构——华大基因,其借助高性能计算优势在基因测序相关研究及应用上作出了令人瞩目的成绩,而其在全新基于英特尔微异构架构的高性能计算平台上的测试,取得了重大进展进一步加速了基因测序。
高性能计算助力基因测序
“每个人约有1万亿个细胞,每个细胞里面都有23对染色体,这些染色体中包含的DNA由ATCG不同碱基序列构成,数量共计达30亿,这些基因序列就是破解人类遗传信息奥秘的钥匙”,华大基因高性能计算研发主管王丙强博士介绍到,基因测序工作就是要通过大规模的计算分析从海量的数据信息中辨识载有的基因及其序列,最终获取遗传信息。
人类基因组计划 (human genome project, HGP) 旨在绘制人类基因组图谱最终达到破译人类遗传信息目的,该计划于1990年正式启动,而这也正是催生华大基因成立的重要原因。庞大而复杂的海量数据早已超出人类计算的能力,要想及时且准确地大规模处理这些数据就不得不依靠计算机的高性能计算。“华大基因一直非常重视高性能计算平台的建设”,王博士介绍到,华大基因建立了基于高性能计算的大规模测序、生物信息、克隆、健康、农业基因组等技术平台,其测序能力及生物信息分析能力世界领先。自1999年成立以来,华大基因成功完成了国际人类基因组计划“中国部分”在其中承担了绝大部分工作,并在Nature和Science等国际一流的学术杂志上发表百余篇学术论文,奠定了中国基因组科学在国际上的领先地位。
华大基因目前已在深圳、香港、北京和武汉等地建立多个大型生物信息超级计算中心,总峰值计算能力达到200T flops,总内存容量达到35TB,总存储能力达到16PB。这为海量生物信息学数据的存储、处理和分析提供了稳定而高效的保障。其中位于深圳和香港的两个中心,是目前中国最大的两个生物信息超级计算中心。
华大基因展示的杂交石斑鱼,其生长速度和体重是普通石斑鱼的2-3倍,而且口感更好
至强融核 进一步加速基因测序
在寻求更快更高效的高性能计算基因测序方案的过程中,华大基因一直在尝试新的技术和方法来进一步加速基因测序。面对复杂的基因测序数据处理,既要拥有高性能的计算能力,又要考虑其经济效益,并结合未来在相关研究的发展,经过多番考量和研究,华大基因最终选择了与英特尔联手启动关于至强融核协处理器在生命科学领域的应用项目。
至强融核协处理器(Xeon Phi)是英特尔面向高度并行的高性能计算(HPC)应用所推出的协处理器,能够提供多达 61个内核、244个线程和 1.2万亿次浮点运算性能,此外其余英特尔至强处理器架构使用同样的编程语言、并行模式、技术和开发人员工具,具有迁移便捷编程可移植等优势。
“我们愿意尝试英特尔至强融核,首先是看中了其编码的简单可移植性,这是来自基因测序相关程序的重要需求;其次,我们在未来想借助2013年在全球高性能计算机500强排名第一的广州天河二号超级计算机的计算能力,而它就正是就基于英特尔微异构的。”华大基因高性能计算研发主管王丙强博士介绍到。
英特尔微异构 效果超出预期
华大基因在基因测序计算中应用的是BWA(Burrows-Wheeler Aligner),是基因研究中一款十分优秀并且被广泛使用的序列比对软件。“由于BWA软件代码分支多,并且有很多随机访问,起初我们认为BWA移植效果可能不会太好”,王丙强博士介绍到,“然而,实际测试的性能表现非常不错,大大超出了我们的预期,我们共尝试了6种优化方法,获得的最好加速比能达到2.19。”
值得一提的是,微异构代码迁移和优化上也带来了很多优势,王丙强表示,代码的修改工作量的确不大。“只需要对源代码进行很小幅度的修改,是添加一些辅助编译指示,就能在微异构上运行的相当好。”他说。
更强计算力 加速生命解谜
在测试基于英特尔微异构的高性能计算平台的同时,华大基因也正在执行3M百万基因组计划,即百万动植物基因组计划、百万人基因组计划、百万微生态基因组计划,该项目将联合全球科学家,通过上百万样本的测序构建遗传信息的数据库,进一步推动基因组测序和生物信息分析技术在粮食安全、医学应用、生态保护等重大发展问题的应用。
“当面对如此规模的数据的项目时,华大基因的计算能力仍显得有些不足,因此一方面我们不断扩充自身的数据中心,另外也在考虑借助天河二号这样的超级计算机的计算能力”,王丙强博士介绍到,“这些项目对计算能力的需求非常大,未来就看微异构如何来加速这些基因测序的计算和分析了。”
本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
9月2日消息,不造车的华为或将催生出更大的独角兽公司,随着阿维塔和赛力斯的入局,华为引望愈发显得引人瞩目。
关键字:
阿维塔
塞力斯
华为
加利福尼亚州圣克拉拉县2024年8月30日 /美通社/ -- 数字化转型技术解决方案公司Trianz今天宣布,该公司与Amazon Web Services (AWS)签订了...
关键字:
AWS
AN
BSP
数字化
伦敦2024年8月29日 /美通社/ -- 英国汽车技术公司SODA.Auto推出其旗舰产品SODA V,这是全球首款涵盖汽车工程师从创意到认证的所有需求的工具,可用于创建软件定义汽车。 SODA V工具的开发耗时1.5...
关键字:
汽车
人工智能
智能驱动
BSP
北京2024年8月28日 /美通社/ -- 越来越多用户希望企业业务能7×24不间断运行,同时企业却面临越来越多业务中断的风险,如企业系统复杂性的增加,频繁的功能更新和发布等。如何确保业务连续性,提升韧性,成...
关键字:
亚马逊
解密
控制平面
BSP
8月30日消息,据媒体报道,腾讯和网易近期正在缩减他们对日本游戏市场的投资。
关键字:
腾讯
编码器
CPU
8月28日消息,今天上午,2024中国国际大数据产业博览会开幕式在贵阳举行,华为董事、质量流程IT总裁陶景文发表了演讲。
关键字:
华为
12nm
EDA
半导体
8月28日消息,在2024中国国际大数据产业博览会上,华为常务董事、华为云CEO张平安发表演讲称,数字世界的话语权最终是由生态的繁荣决定的。
关键字:
华为
12nm
手机
卫星通信
要点: 有效应对环境变化,经营业绩稳中有升 落实提质增效举措,毛利润率延续升势 战略布局成效显著,战新业务引领增长 以科技创新为引领,提升企业核心竞争力 坚持高质量发展策略,塑强核心竞争优势...
关键字:
通信
BSP
电信运营商
数字经济
北京2024年8月27日 /美通社/ -- 8月21日,由中央广播电视总台与中国电影电视技术学会联合牵头组建的NVI技术创新联盟在BIRTV2024超高清全产业链发展研讨会上宣布正式成立。 活动现场 NVI技术创新联...
关键字:
VI
传输协议
音频
BSP
北京2024年8月27日 /美通社/ -- 在8月23日举办的2024年长三角生态绿色一体化发展示范区联合招商会上,软通动力信息技术(集团)股份有限公司(以下简称"软通动力")与长三角投资(上海)有限...
关键字:
BSP
信息技术
山海路引 岚悦新程 三亚2024年8月27日 /美通社/ -- 近日,海南地区六家凯悦系酒店与中国高端新能源车企岚图汽车(VOYAH)正式达成战略合作协议。这一合作标志着两大品牌在高端出行体验和环保理念上的深度融合,将...
关键字:
新能源
BSP
PLAYER
ASIA
上海2024年8月28日 /美通社/ -- 8月26日至8月28日,AHN LAN安岚与股神巴菲特的孙女妮可•巴菲特共同开启了一场自然和艺术的疗愈之旅。 妮可·巴菲特在疗愈之旅活动现场合影 ...
关键字:
MIDDOT
BSP
LAN
SPI
8月29日消息,近日,华为董事、质量流程IT总裁陶景文在中国国际大数据产业博览会开幕式上表示,中国科技企业不应怕美国对其封锁。
关键字:
华为
12nm
EDA
半导体
上海2024年8月26日 /美通社/ -- 近日,全球领先的消费者研究与零售监测公司尼尔森IQ(NielsenIQ)迎来进入中国市场四十周年的重要里程碑,正式翻开在华发展新篇章。自改革开放以来,中国市场不断展现出前所未有...
关键字:
BSP
NI
SE
TRACE
上海2024年8月26日 /美通社/ -- 第二十二届跨盈年度B2B营销高管峰会(CC2025)将于2025年1月15-17日在上海举办,本次峰会早鸟票注册通道开启,截止时间10月11日。 了解更多会议信息:cc.co...
关键字:
BSP
COM
AI
INDEX
上海2024年8月26日 /美通社/ -- 今日,高端全合成润滑油品牌美孚1号携手品牌体验官周冠宇,开启全新旅程,助力广大车主通过驾驶去探索更广阔的世界。在全新发布的品牌视频中,周冠宇及不同背景的消费者表达了对驾驶的热爱...
关键字:
BSP
汽车制造
此次发布标志着Cision首次为亚太市场量身定制全方位的媒体监测服务。 芝加哥2024年8月27日 /美通社/ -- 消费者和媒体情报、互动及传播解决方案的全球领导者Cis...
关键字:
CIS
IO
SI
BSP
上海2024年8月27日 /美通社/ -- 近来,具有强大学习、理解和多模态处理能力的大模型迅猛发展,正在给人类的生产、生活带来革命性的变化。在这一变革浪潮中,物联网成为了大模型技术发挥作用的重要阵地。 作为全球领先的...
关键字:
模型
移远通信
BSP
高通
北京2024年8月27日 /美通社/ -- 高途教育科技公司(纽约证券交易所股票代码:GOTU)("高途"或"公司"),一家技术驱动的在线直播大班培训机构,今日发布截至2024年6月30日第二季度未经审计财务报告。 2...
关键字:
BSP
电话会议
COM
TE
8月26日消息,华为公司最近正式启动了“华为AI百校计划”,向国内高校提供基于昇腾云服务的AI计算资源。
关键字:
华为
12nm
EDA
半导体