清华大学生物医学交叉研究院黄牛课题组合作突破万亿级别虚拟筛选核心技术瓶颈
2025/12/19
近日,清华大学生物医学交叉研究院黄牛课题组联合山东大学、清华大学和国家超级计算无锡中心相关团队协同攻关,成功构建新一代性能可移植虚拟筛选框架SWDOCKP²,在国产最新一代“神威”超级计算机“神威·海洋之光”上,实现每日1.9万亿个蛋白质–配体分子对接的理论计算速度,将基于结构的虚拟筛选能力推向接近整个人类蛋白质组的覆盖规模。相关研究成果在高性能计算领域顶级学术会议——2025全球超级计算大会(SC25)上报告,获得广泛关注。
现代小分子药物研发流程复杂,需历经靶点发现与验证、先导化合物发现与优化、临床前研究及多阶段临床试验等关键环节。整个研发周期长达十余年,投入动辄数十亿美元。与此同时,“按需合成”(make-on-demand)虚拟化合物库规模呈爆发式增长,从十年前的百万规模飙升至十亿甚至百亿级别,既极大拓展了可探索的化学空间,也带来了前所未有的计算压力。
面对超大规模虚拟筛选的技术难题,联合团队充分发挥超级计算机的极致并行能力,采用基于物理原理的“暴力筛选”策略,正面突破计算瓶颈。团队以虚拟筛选经典软件UCSF DOCK3.7为基础,针对“神威”超级计算机架构进行深度移植、重构与优化,开发全新虚拟筛选软件SWDOCK,能够在合理的时间内高效处理数十亿乃至上百亿小分子,加速先导化合物发现流程。
尽管SWDOCK已实现重大突破,但人类蛋白质组规模的虚拟筛选仍存在亟待解决的难题。一方面,UniProt与PDB等数据库已收录超过2万个人体蛋白质的序列和结构信息,AlphaFold等工具进一步拓展了蛋白质结构资源;而另一方面,化合物库规模指数级增长。据Pharos平台统计显示,仅3.4%的人类蛋白靶点拥有获批小分子药物,大量潜在治疗靶点亟待挖掘。
为此,联合团队持续攻关,推出虚拟筛选软件升级版本SWDOCKP²。2025年11月,在美国圣路易斯召开的SC25会议上,团队作专题报告“每日万亿配体:基于复合数据库优化和多靶点对接的高性能便携式虚拟筛选”(Trillion Ligands per Day: Performance-Portable Virtual Screening via Compound Database Optimization and Multi-Target Docking),系统介绍性能可移植的跨平台虚拟筛选框架SWDOCKP²。该框架可调度“神威·海洋之光”超算3900万个计算核心,同时对接8个蛋白质靶标结构,实现每日1.9万亿个蛋白质–配体对的理论筛选速度,较此前领先水平提升一个数量级。
通过整合小分子预采样构象系综数据库、高性能优化的SWDOCK与SWDOCKP²软件,以及“神威·海洋之光”的庞大算力,联合团队不仅实现了筛选性能的跨越式提升,更具备了构建规模高达10¹³个蛋白质——配体复合物预测构象数据集的能力——该数据集将成为同类公开资源中规模最大的数据库。基于此数据集训练的人工智能模型,有望突破药物研发中数据稀缺的核心瓶颈,推动AI驱动的配体预测、结构生成等前沿应用发展。
SWDOCKP²核心创新集中在三个方面。多靶标并行:能量网格融合结合三线性SIMD插值算法优化,即针对蛋白质组规模筛选中“多同源蛋白、多功能构象”的并行对接需求,SWDOCKP²创新提出“多靶标并行处理”策略。构象系综重构使能“早淘汰”机制:在配体小分子侧,团队对化合物构象系综数据库进行精细化重构。通过对构象基础单元(confs)的排序与归并,将对接打分阶段的迭代量降低近一半。跨平台兼容:从神威走向通用CPU。为打破平台壁垒,团队在SWDOCKP²中引入基于OpenMP的AthreadS兼容层,该设计使得针对神威架构优化的应用可快速移植至通用CPU平台,大幅提升代码性能可移植性,为开源学术社区贡献关键技术支撑。
山东大学软件学院研究员段晓辉、清华大学计算机系/北京生命科学研究所联合培养博士后沈成、北京生命科学研究所/清华大学生物医学交叉研究院2022级博士生陈高伟为论文共同第一作者。段晓辉、清华大学教授杨广文、山东大学教授刘卫国以及北京生命科学研究所/清华大学生物医学交叉研究院研究员黄牛为论文共同通讯作者。
文章来源清华大学,分享只为学术交流,如涉及侵权问题请联系我们,我们将及时修改或删除。
-
2026年第八届计算机科学与技术在教 109
-
2026年3月高含金量国际学术会议合 88
-
2026资源、化学化工与应用材料国际 1265
-
2026年人工智能教育技术与数据科学 246
-
2026年图像处理与数字创意设计国际 1041
-
2026年机械工程,新能源与电气技术 5524
-
2026年材料科学、低碳技术与动力工 1312
-
2026年第二届无线与光通信国际会议 2080
-
第七届多组学科研与临床应用大会 02-05
-
2026年制药学、生物技术与植物学国 02-04
-
2026年节能技术、低碳发展与可持续 02-04
-
2026年导航控制、传感技术与卫星应 02-04
-
2026年经济转型与商业文化国际学术 02-04
-
2026年体育科学、运动健康与创新管 02-04
-
2026创意城市、设计与社区建设国际 02-04
-
2025年两院院士增选有效候选人4066
-
2025最新JCR分区及影响因子10070
-
好学术:科研网址导航|学术头条分5098
-
2025年国际期刊预警名单发布!5129
-
2025年中科院期刊分区表重磅发16711
-
中国科协《重要学术会议目录(2010250
-
吉林大学校长张希:学术会议中的提6245
-
bbrc期刊,bbrc期刊处于S02-03
-
siam期刊,siam期刊发的最02-03
-
了望期刊,瞭望期刊02-03
-
共享经济期刊,共享经济学术论文02-03
-
期刊代理网,从哪里找期刊代理02-03
-
light期刊,Light期刊综02-03
-
传承 期刊,传承期刊投稿点评02-03
-
期刊勘误,期刊勘误时会索要原始数02-03
-
复旦大学附属眼耳鼻喉科医院 8237

-
cosco-logistics 18318

-
上海鸿与智商业媒体 2309

-
浙江湖州长兴娇家有限公司 21200

-
联合医学会展有限公司 18486

-
武汉csip主办方 18311

-
三峡工程大酒店 18136

-
中华医学会 21564

-
第八届电子与信息工程国际会议 21708

-
清华大学丘成桐数学科学中心 8448

-
北京多维路桥 18622

-
宁波德泰中研信息科技有限公司 8298

-
《环球杂志》 21644

-
中国腐蚀与防护学会 18241

-
湖北新文盛会务有限公司 23259

-
华东交通大学 2218

-
美通社北京分公司 2278

-
湖南省系统工程与管理学会 23637

-
第十六届中国微米纳米技术学会学术 18666

-
合肥工业大学 18688

















76













































