Google 与 Meta 向 Biohub 的 18 亿美元虚拟细胞项目投入 3 亿美元

新闻摘要
2026 年 10 月 7 日(美国东部时间),Google DeepMind、Alphabet 旗下的药物研发部门 Isomorphic Labs 以及 Meta 同意共同向 Biohub 的虚拟生物学计划投入 3 亿美元,用于构建能够预测人类细胞行为的 AI 模型。Biohub 是由 Mark Zuckerberg 和 Priscilla Chan 支持的科研机构。加上 Biohub 自身以及两家美国联邦机构的承诺资金,该项目目前被描述为一项约 18 亿美元的宏大计划,目标是以史无前例的规模生成开放的生物学数据。
什么是“虚拟细胞”?
虚拟细胞是一种计算模型,能够预测活细胞在发生变化时的反应,例如某个基因被关闭、加入某种药物或发生感染等。研究人员无需在实验室中逐一开展所有实验,而是可以先向模型提问,只在实验台上验证最有希望的结果。这一思路与大语言模型从海量文本中学习规律的方式类似。然而,生物学领域一直缺乏同等规模且一致的大规模测量数据集,而这项计划正是要填补这一空白。
各方出资情况
据 CNBC、Quartz 等媒体报道,该项目的资金结构分为多个层级。Google DeepMind、Isomorphic Labs 和 Meta 合计承诺出资 3 亿美元。Biohub 于 2026 年 4 月承诺出资 5 亿美元,其中 1 亿美元用于外部研究和协同数据生成,4 亿美元用于技术开发和内部数据生成。美国能源部计划在未来五年内投入超过 5 亿美元,用于生物测量、建模和计算。美国国立卫生研究院则贡献了基于此前逾 5 亿美元联邦投资所积累的数据集和资源。将这些部分相加,便得出了 18 亿美元这一总体数字。需要注意的是,Biohub 官方页面提到的是 20 亿美元的更大规模承诺,因此具体总额会因统计口径不同而略有差异。
数据将如何生成
该计划旨在测量细胞在远超以往科学家测试范围的更多条件下的反应。规划中的数据类型包括基因组学、转录组学和蛋白质组学测量数据,细胞和组织层面的成像数据,可揭示近原子分辨率结构的冷冻电子断层扫描数据,以及新一代空间组学和显微成像数据。Biohub 的合作伙伴包括 Allen Institute、Arc Institute、Broad Institute、Human Cell Atlas、Human Protein Atlas、Wellcome Sanger Institute,作为技术合作伙伴的 NVIDIA,以及由 MIT、Stanford 和 UCSF 等 17 家机构联合发起的 Billion Cells Project。
时间表与目标
首个数据集预计将在一年左右发布,目标是在五年内建成高精度的预测模型。Biohub 科学负责人 Alex Rives 表示:“要构建能够准确呈现生物学全部复杂性的 AI,我们需要的数据量必须比现有规模高出几个数量级。”
带有商业激励的开放数据
数据将公开共享,但附带一项特殊安排:由商业合作伙伴资助的数据在公开发布前设有一年的禁发期,而政府资助的数据则没有禁发期。Rives 解释道:“我们必须为商业参与者提供一定的激励,让他们愿意加入,而禁发期正是为此设立的。”这种模式让企业能够率先获益,随后更广泛的研究群体也能获取这些数据。
Google 和 Meta 为何参与其中
Isomorphic Labs 已与 Eli Lilly、Novartis 等制药公司展开合作,并于 2025 年 3 月从外部投资者处融资 6 亿美元,因此更优秀的细胞模型与其药物研发业务直接契合。对 Meta 和 Google DeepMind 而言,大规模且标注完善的生物学数据集有望成为下一代科学 AI 的训练素材。Biohub 此前已释放出这一方向的信号:Zuckerberg 和 Chan 在 2025 年 11 月表示,他们将把大部分慈善事业转向科学和 AI 驱动的生物学领域,并且 Biohub 将收购 AI 实验室 EvolutionaryScale。
后续关注重点
首个里程碑是预计在 2027 年底前后发布的初始数据集。研究人员将密切关注其发布速度、各实验室之间测量数据的一致性,以及早期模型能否预测细胞在其未接受过训练的条件下的反应。如果能够做到这一点,该方法有望缩短从基础生物学研究到开发新疗法的周期。由于调研期间无法直接访问 The Verge 的原始报道,本文细节均通过 CNBC、Quartz、Axios 的标题报道、TIKR 以及 Biohub 官方公告交叉核实。