基于组学与结构预测的药物研发项目简介

来源: 前沿交叉学科研究院    发稿时间:2025-11-23

1.项目介绍

新型传染病的出现带来了前所未有的挑战,而肿瘤、自身免疫病和慢性炎症等疾病长期威胁着人类健康。在这些疾病的药物研发中,抗体类药物占90%以上。针对生物实验开发抗体药物成本高昂和成功率低的问题,本项目结合统计学、生命科学、人工智能等多个学科领域,基于单细胞转录组和空间转录组等组学技术以及针对抗体抗原的蛋白质复合物结构预测,建立从抗原靶点筛选、抗体药物筛选以及抗体优化的抗体类药物研发的新的计算方法,提高目前基于生物湿实验的抗体类药物研发的研发效率。

本项目依托多组学数据分析、利用结构预测算法预测的抗体-抗原复合物结构,结合深度学习模型、蛋白质语言模型、高维数据统计分析等AI与数学统计模型,开发一套独立自主的抗原抗体筛选、抗体优化及抗体脱效应研究的算法。并对5-10种不同疾病的抗原蛋白进行抗体筛选,并对筛选出的抗体进行生物实验验证,力争获得2-3个有效抗体。项目旨在通过统计学、人工智能与生物化学和分子生物学的深度交叉以及多学科、多交叉领域项目组成员为学术领域和企业培养统计学和生命科学的交叉研究和教学的高层次人才,欢迎有志于统计学、人工智能与生物学交叉领域研究的学生报考本项目。

项目将单细胞/空间多组学中的疾病微环境解析、蛋白质结构预测技术、蛋白质设计技术、抗原表位识别与抗体-抗原复合物结构预测,配合冷冻电镜结构解析,生物实验验证等,统一到同一计算实验框架,从疾病状态靶点发现结构识别候选抗体优化脱靶风险评估建立可迭代的理论模型。技术上拟融合组学分析、蛋白质结构预测与设计、蛋白质功能预测、高维统计建模、深度学习、蛋白质语言模型、蒙特卡洛搜索和全蛋白组结构比对,形成具有自主特色的抗体类药物计算筛选与优化方法。

项目预期形成一套抗原靶点发现、抗体筛选、亲和力/特异性优化和脱靶效应评估的算法流程与软件原型,在1-3种疾病相关抗原上开展应用验证,筛选若干高质量候选抗体并力争获得2-3个具有进一步转化潜力的有效抗体。人才培养方面,依托双导师和交叉导师组培养兼具统计建模、AI算法、生物分子结构与实验验证理解能力的博士研究生,产出高水平论文、算法工具、专利。

2.项目负责人及团队骨干

  胡刚教授、数据科学系主任博士生导师。传染病溯源与智能决策全国重点实验室PI。研究方向:生物信息学、计算生物学和统计基因组学,获得天津市自然科学一等奖一项,主持国家自然科学基金重大研究计划、天元基金交叉重点专项、面上项目等项目多项。开发了一系列单细胞转录组和空间转录组数据分析和去噪工具并被广泛引用。

  郑伟教授博士生导师国家级海外青年人才,南开大学百名青年学科带头人,传染病溯源预警与智能决策全国重点实验室PI,中国疾病预防控制中心病毒病预防控制所兼职教授,生物分子结构预测与模拟专委会委员。研究方向蛋白质单体结构预测、蛋白质-蛋白质复合物结构预测、核酸-核酸复合物结构预测、蛋白质-核酸复合物结构预测、生物分子多构象预测算法等。主导开发的蛋白质结构预测算法,精度超过AlphaFold系列算法,并多次获得世界蛋白质结构预测大赛冠军,多次受邀国际会议做特邀报告。累计在Nature BiotechnologyNature MethodsNature CommunicationsPNAS等高水平SCI期刊发表文章60余篇。主导开发的算法已经累计服务了超过100个国家的近10万名用户

  郭宇教授、博士生导师。广州国家实验室双聘研究员,第十三届全国青联委员。研究方向:重大传染性疾病的致病机制研究及药物开发工作,主持承担国家重点研发计划、国家自然科学基金、国家实验室应急攻关、重大校企合作等项目。入选国家高层次人才计划,中国科协“青年人才托举工程”等人才项目,荣获全国“向上向善好青年”,天津市青年科技奖等荣誉称号。

  张宏恺教授、博士生导师。国家“四青”,国家重点研发计划项目负责人,国药中生-南开大学联合研发中心首席科学家,上海科技大学免化所客座教授。研究方向:肿瘤靶向及肿瘤免疫治疗药物的研发工作,同时开展各种抗癌药物的耐药机制研究。课题组为博士和硕士研究生提供了优秀的科研条件和生活支持,博士毕业生均以第一作者发表至少一篇十分以上医学一区论文,目前多就职于大学和科研院所、央企或上市药企、三甲医院或到国外知名大学深造。

  冯龙教授、博士生导师。入选教育部青年人才计划、南开大学百名青年学科带头人。研究方向:高维数据分析方面的研究在统计学国际顶尖杂志JRSSB、 JASABiometrikaAnnals of StatisticsJOEJBES等发表50余篇论文。主持一项天津市杰出青年基金、国家自然科学基金面上项目和青年项目。担任Statistical Theory and Related Field副主编。

  顾然教授博士生导师。中国运筹学会算法软件与应用分会理事,天津市工业与应用数学学会常务理事,青年工作委员会主任委员。研究方向:最优化理论与算法及其应用。主持国家自然科学基金青年项目,参与国家重点研发计划,入选国家高层次人才引进计划青年项目和天津市杰出青年科学基金项目。

  黄羽岑研究员、博士生导师研究方向:病毒感染和复制、与宿主相互作用过程中的分子机制,以及对病毒生命过程进行调控的手段。在冠状病毒转录复制机制的研究中,取得了具有影响力的创新性成果,在CellScience等国际期刊上以共同第一作者身份发表研究论文5篇,论文总计被引2100余次(google scholar)。曾获吴瑞奖、博士后创新人才支持计划等。研究成果获教育部科学研究优秀成果奖一等奖、中华医学科技奖青年科技奖等。

  张立云教授、博士生导师南开国际先进研究院(深圳福田)、南开大学深圳研究院副院长。国际化学生物学学会理事,中国分析测试协会核酸分析分会委员。先后在中国科学技术大学、中国科学院合肥物质科学研究院、新加坡国立大学、美国伊利诺伊大学厄巴那-香槟分校、英国牛津大学学习与工作。主要从事光电驱动酶催化生物合成与生物传感研究,在J. Am. Chem. Soc, Biosens. Bioelectron.等期刊发表论文60余篇,授权中国发明专利10余项;先后主持国家重点研发计划“合成生物学”重点专项、国家自然科学基金面上项目、天津市重点项目等9项科研项目。

3.项目拟推进的多学科交叉研究方向

(1基于时空多组学数据的计算分析系统

围绕肿瘤、感染、自身免疫和慢性炎症等疾病场景,整合单细胞转录组、空间转录组、蛋白组及临床表型数据,建立疾病细胞状态、空间生态位和抗原表达谱的联合解析方法。重点发展去噪、批次校正、细胞通讯、空间共定位和靶点优先级排序算法,为后续抗原筛选和机制解释提供可量化的数据基础。

(2基于高维统计及深度学习预测结构的抗体筛选

面向候选抗原和抗体序列空间巨大、实验筛选成本高的问题,结合高维统计推断、蛋白质语言模型和基于AI抗体-抗原复合物三维结构预测,构建抗体结合能力、表位覆盖、稳定性和可开发性的一体化评分体系。通过计算预筛选缩小实验验证范围,提高候选抗体发现效率,并形成可解释的筛选依据。

(3结合蒙特卡洛算法与深度学习的抗体优化

针对初始候选抗体亲和力、特异性或稳定性不足的问题,建立序列突变、结构重排和能量评估相结合的抗体优化策略。通过蒙特卡洛等技术搜索探索可行突变组合,利用深度学习模型预测亲和力、构象稳定性、免疫原性和表达可行性,在多目标约束下获得更适合实验验证与后续转化的优化抗体。

4)基于人体全蛋白组结构的抗体脱靶效应研究

围绕抗体药物安全性和特异性评估,利用人体全蛋白组结构库、结构相似性搜索和潜在表位比对,系统识别候选抗体可能结合的非目标蛋白或同源表位。进一步结合组织表达、疾病相关性和功能注释评估脱靶风险,为抗体优化、适应症选择和实验验证优先级提供计算依据。

4.项目制研究生招生专业背景要求

本项目面向统计学、数学、计算机科学与技术、人工智能、生物信息学、计算生物学、生物学、结构生物学等相关背景考生招生。重点欢迎具备以下能力之一或多项基础的学生报考:高维统计建模、机器学习/深度学习、蛋白质结构预测与分子模拟、多组学数据分析、抗体工程、分子生物学或药物研发实验训练。考生不局限于现有学科专业目录,鼓励具有交叉研究经历、较强编程能力、数学建模能力或生物实验理解能力,并有志于从事AI与统计驱动抗体药物研发的学生申请。

5.项目组联系方式

联系人:胡刚

胡刚邮箱:huggs@nankai.edu.cn

胡刚主页:https://my.nankai.edu.cn/stat/hg/list.htm

郑伟邮箱:jlspzw@nankai.edu.cn

郑伟主页:https://my.nankai.edu.cn/stat/zw/list.htm

郭宇邮箱:guoyu@nankai.edu.cn

郭宇主页:https://sky.nankai.edu.cn/gy/list.htm

张宏恺邮箱:hongkai@nankai.edu.cn

张宏恺主页:https://sky.nankai.edu.cn/zhk/list.htm

冯龙邮箱:flnankai@nankai.edu.cn

冯龙主页:https://my.nankai.edu.cn/stat/fl/list.htm

顾然邮箱:rgu@nankai.edu.cn

顾然主页:https://my.nankai.edu.cn/stat/gr/list.htm

黄羽岑邮箱:huangyc@nankai.edu.cn

张立云邮箱:liyunzhang@nankai.edu.cn

张立云主页:https://sky.nankai.edu.cn/zly/list.htm