中国生物大模型GeneLLM能帮助发现新药吗?
中国生命科学领域正迎来自己的“DeepSeek时刻”——由深圳初创公司津渡生科研发的GeneLLM多组学大模型,不仅是全球首个直接从组学原始数据预训练的生物大模型,其研究成果更接连登上了国际顶刊《Nature Communications》与《Advanced Science》,这款被称为“中国版生物DeepSeek”的模型正在探索用AI理解生命的“多种语言”,为新药发现开辟全新路径。
一、GeneLLM是什么?——中国首个生命科学基础大模型
核心研发团队:津渡生科由四位牛津大学归国学者创立,专注于生命科学垂类大模型研发。
技术定位:GeneLLM是全球首个直接使用组学原始数据(如基因组、转录组等)进行预训练的多组学大模型,而非依赖已有文献或数据库的二次加工数据。
学术认可:该模型已接连登上《Nature Communications》与《Advanced Science》两大国际顶级学术期刊,标志着国际学术界对其实力的认可。
行业地位:被业界视为继谷歌AlphaFold、斯坦福EVO 2之后的又一重磅模型,填补了中国在生命科学基础大模型领域的空白。
二、GeneLLM如何帮助发现新药?——AI理解生命的“系统语言”
理解多种生物“语言”:传统AI模型通常只处理单一类型数据,而GeneLLM能同时读懂基因、蛋白质、代谢物等多维组学数据,相当于AI开始理解整个生命系统的“对话”。
加速药物靶点发现:通过模拟基因扰动对细胞活动的影响,AI可快速预判实验结果,将过去需要数月甚至数年的海量试错实验缩短至数天。
实现全链条赋能:从靶点发现、药物反应预测到临床试验优化,AI正从辅助工具转变为生物医药研发的核心基础设施,重塑创新药研发模式。
三、AI新药研发的潜力与现实——从理论突破到产业落地
效率革命已来:类似腾讯UniPert–G2CP算法的AI成果已登上《Cell》正刊,显示AI虚拟细胞模拟正成为现实,传统实验阶段的效率瓶颈有望被打破。
中国创新药“DeepSeek时刻”临近:国产创新药在全球授权交易中占比从2023年的20%飙升至2025年的42%,部分药物疗效已能媲美国际明星药,产业正从仿制药大跨步迈向创新药时代。
仍需与传统实验互补:当前AI模型的输出仍需通过真实湿实验(如细胞实验、动物实验)进一步验证,但AI可大幅减少不必要的试错成本,帮助科研人员将精力聚焦在最有潜力的方向上。