打开网易新闻 查看精彩图片

“说 AI 能治愈癌症更像是一种陈词滥调,而非鼓舞人心,大多数人认为这是欺骗性的。”

8 月 16 日,Anthropic 首席执行官 Dario Amodei 在 X 上写下了这句话。两天后,Anthropic 公布了一项蛋白质设计实验:Claude 操作一组专业模型和研究工具,设计出了能够与多个目标蛋白结合的新蛋白。再过一天,莫德纳和默沙东宣布,包含机器学习设计环节的个体化癌症疫苗在黑色素瘤三期试验中达到主要终点。

几项成果集中出现,再次激起了外界对 AI 医疗的关注,资本市场也迅速作出反应。8 月 19 日,莫德纳股价上涨约177%,默沙东上涨约 13%;Anthropic 相关实验的验证方 Twist 股价单日上涨 22.64%、从事 AI 精准医疗的 Tempus AI 也上涨 22%。热度随后扩散到整个生物科技板块,iShares Biotechnology ETF 和 SPDR S&P Biotech ETF 当天分别上涨 6.6% 和 5.9%。

从蛋白质设计、AI 药物发现,到个体化癌症疫苗的三期试验,“AI 医疗”开始对应越来越具体的研究成果。那么,这些进展分别到了哪一步?哪些已经经过人体临床验证,哪些还停留在实验室;AI 又在其中承担了什么工作?它真的帮助人类“治愈”癌症了吗?

“治愈”有着非常严格的要求

“AI 医疗”听起来像一个单独的行业,但它内部其实包含一系列差别很大的工作。

算法可以阅读病历、识别影像、预测疾病风险,也可以寻找药物靶点、生成分子结构、筛选临床试验患者。它还可以辅助医生选择治疗方案、计算放疗剂量,或者监测患者服药后的反应。

这些工作都与医疗有关,证据标准却各不相同。

一个模型在医学考试中答对问题,证明的是它能处理某种形式的文本;在历史病例上准确预测诊断,证明的是它能复现数据中的模式;在医院里帮助医生提高诊断率,需要前瞻性试验;一种由 AI 参与设计的药物是否有效,最终还要在患者身上与现有治疗或者安慰剂进行比较。

美国食品药品监督管理局(FDA)称,自 2016 年以来已经收到超过 500 份包含 AI 组件的药品和生物制品申报材料。这里的“使用 AI”可以指预测药代动力学、优化剂量、分析临床终点、整合自然病史数据,也可以指辅助生产和质量控制。它说明 AI 已经成为药物研发中的常用工具,并不意味着 500 款药物由 AI 独立发明。

已经获得监管授权的医疗 AI,同样主要分布在信息处理环节。JAMA 2025 年的一项系统研究统计了 950 款 FDA 授权的 AI 医疗器械,其中 723 款属于放射科,占比约 76%。它们处理的是 X 光片、CT、核磁共振和超声等高度数字化的数据。

医学影像有相对标准的输入格式,医院也已经积累了大量数字化资料,许多任务也拥有明确答案,例如一张图像中是否存在结节,病灶边界在哪里,前后两次检查发生了什么变化。因此,这也是目前聚集了最多 AI 产品的医疗环节。

而对于治疗来说,它所提出的是另一类问题。

诊断模型试图回答“这个患者现在发生了什么”。治疗决策需要回答“采取某项干预后,这名患者会发生什么”。同一个患者不可能同时接受两套相互排斥的方案,研究者无法直接观察那个没有发生的结果。相关性很强的模型,也可能把接受某种治疗的人群特征误认为治疗效果。

这就是随机对照试验仍然重要的原因。Nature Medicine 关于因果机器学习的综述指出,AI 可以结合临床试验和真实世界数据估算个体化治疗效果,但偏差、混杂因素和错误的因果假设仍会产生错误预测。

至于“治愈”,医学要求的不只是治疗后暂时查不到癌细胞,还要确认它以后不再复发。美国国家癌症研究所将其解释为癌症的所有痕迹已经消失,并且以后不会复发。患者即使进入持续多年的完全缓解,医生通常仍然谨慎使用这个词,因为未来尚未发生。

图丨FDA 对于治愈的定义(来源:FDA)
打开网易新闻 查看精彩图片
图丨FDA 对于治愈的定义(来源:FDA)

模型在基准测试或历史病例上取得高分,只能说明它完成了相应的预测任务。患者能否长期获益,则要看对照试验和数年随访。

三项成果,停在三道不同的门前

这种差别,可以从 Anthropic 最近公布的实验说起。

在这组持续 24 至 48 小时的任务中,Claude 通过阅读论文和数据库,调用公开的蛋白质结构预测与设计工具,挑选结合位置,生成候选蛋白,再根据计算结果不断筛选和调整。

研究人员选定了 16 个目标蛋白,其中 15 个最终取得可以解释的测量结果。实验室对 1,320 个设计进行合成和测试,确认 354 个能够结合目标,在 15 个目标中有 14 个找到了结合蛋白。部分任务的命中率超过 Anthropic 此前使用的常规流程。

这是一个扎实的研究成果。Claude 不只是总结已有知识,它连续工作了数十小时,组合专业模型,调整实验策略,交出了能够接受湿实验检验的新设计。外部实验室负责合成和检测,也降低了模型对自己打分的风险。

(来源:Anthropic)
打开网易新闻 查看精彩图片
(来源:Anthropic)

不过,实验对象是 15 个可以解释的蛋白靶点,不是 15 种疾病;354 个结果是蛋白结合物,也不是 354 款药。

一个蛋白能够黏住靶点,只说明研发者找到了某把可能插进锁孔的钥匙。它是否会打开正确的门,会不会同时碰坏其他门,进入人体后能否抵达锁孔,免疫系统是否把它清除,都需要其他实验回答。Anthropic 在报告中也明确表示,这些小型结合蛋白不是标准意义上的药物,结合只是药物研发的第一步。

相比之下,Rentosertib 已经走得更远。这是一款用于治疗特发性肺纤维化的候选小分子药物,其研发公司英矽智能使用 AI 寻找 TNIK 靶点,又通过生成模型设计分子结构。2025 年公布的随机二期临床试验招募了 71 名患者,在为期 12 周的治疗中观察到初步疗效信号,药物总体耐受性尚可。

不过这项研究规模很小,全部组别共有 16 人退出,观察时间也不足以判断长期疗效。研究者在论文中将结果称为“令人鼓舞,值得进一步研究”,而非一项已经得到确认的治疗突破。

2026 年 7 月,Rentosertib 进入三期试验。它是目前最接近完整临床验证的 AI 药物案例之一:AI 参与发现靶点、设计分子,候选药随后经历临床前实验、一期安全性研究、随机二期试验,现在开始接受更大规模的人体检验。它仍未获得上市批准,也没有治愈特发性肺纤维化。

莫德纳的个体化癌症疫苗又处在不同的位置。

研发人员先对每名患者的肿瘤和正常组织进行测序,找出肿瘤特有的突变,再用机器学习和生物信息学算法对候选新抗原排序。最多 34 个新抗原会被编码进一条为患者单独制造的 mRNA,目的是训练免疫系统识别其肿瘤细胞。

在刚刚公布的 INTerpath-001 三期试验中,1,137 名高风险皮肤黑色素瘤患者接受了治疗。这些患者的肿瘤已经通过手术完全切除,研究考察的是疫苗联合 Keytruda 能否降低术后复发和远处转移风险。

公司称,试验在预设的中期分析中达到无复发生存期和无远处转移生存期两个终点。总体生存期仍在随访,风险比、绝对事件率、置信区间和生存曲线尚未披露。

这项三期试验验证了“个体化疫苗加 Keytruda”整套方案的增量效果。它没有设置一组由人类使用其他方法挑选新抗原的疫苗,也没有比较“使用 AI”和“不使用 AI”。因此,研究能够证明包含机器学习环节的疗法有效,无法计算疗效中有多少应当归功于算法。

三项成果分别回答了三个问题:模型能否设计出在实验室中结合靶点的蛋白,AI 发现和设计的候选药能否在人类身上显示初步疗效,包含机器学习组件的个体化疗法能否在三期试验中改善临床终点。

我们不需要用“治愈”的名号来给他们增加分量。Anthropic 提高了蛋白质设计的实验命中率,Rentosertib 把 AI 发现和设计的候选药推进到后期临床,莫德纳则让个体化癌症疫苗首次在三期试验中取得阳性结果。这些已经是足够重要的进展。

最昂贵的失败,发生在算法交卷以后

我们知道,现代药物研发是一套不断淘汰答案的制度。

研究人员从疾病机制中寻找靶点,从大量候选分子中找到能够影响靶点的少数,再优化活性、稳定性、选择性和生产条件。候选药随后进入细胞实验、动物实验和人体临床试验。每一步都会淘汰前一步看起来很有希望的结果。

一项关于临床研发失败的综述估计,药物从发现到获批通常需要 10 至 15 年。即使已经进入一期人体试验,约九成候选药仍无法获得批准。40%—50% 的失败源于临床疗效不足,约 30% 源于无法接受的毒性。

(来源:Acta Pharm Sin B)
打开网易新闻 查看精彩图片
(来源:Acta Pharm Sin B)

而这组数字揭示了 AI 药物研发最容易被忽略的一点:生成一个在计算上表现优秀的候选物,可能只加速了失败率最高流程中的前半段。

靶点与疾病相关,不等于干预靶点就能改善疾病;分子在培养皿中有效,不等于它在人体内能够达到足够浓度;动物模型出现变化,也不保证人类患者获得同样结果。许多“完美”的候选药,直到二期或者三期临床才暴露出疗效不足。

AlphaFold 就很好地代表了这种区别。它已经预测了约 2 亿个蛋白质结构,极大扩展了研究人员可以利用的结构信息。以前可能需要数月甚至数年才能获得的线索,现在几分钟便能生成。科学家能够更快提出假设,也可以研究一些过去缺乏实验结构的蛋白。

但模型给出的通常是一个预测构象,而真实蛋白会在不同温度、溶液环境和结合状态下改变形态,也可能与其他蛋白、离子和小分子共同作用。研究人员比较 AlphaFold 预测与实验结构后发现,即便模型置信度很高,局部构象、侧链位置和结构域方向仍可能不同。因此,这些预测更适合被视为“非常有价值的假设”,关键相互作用仍需实验确认。

AI 可以提出更多候选答案,生命科学缺少的却经常是高质量问题和能够检验答案的数据。

2026 年 8 月,Nature Reviews Drug Discovery 发表的一篇行业评述认为,AI 在药物研发中的技术成果很多,临床相关影响仍然有限。作者把原因归结为几类:研究过度关注模型指标,生命科学数据高度依赖实验条件,现实任务没有被准确描述,技术团队解决了一个容易计算的问题,却未必解决药物研发中真正阻塞决策的问题。

比如,一个生成模型可以在几小时内创造数百万个分子。但实验室没有能力合成和检测其中大部分,更多候选物甚至会放大后续筛选压力。真正有价值的提升是把最可能失败的分子尽早排除,让有限的实验资源集中到更好的假设上。

在这个意义上,“更快失败”也可能是 AI 对医学的重要贡献。它不等于“治愈”,却可能节省数年时间和数亿美元成本。

癌症会在治疗过程中改写题目

而就这次引发关注的癌症来说,它所对应的问题更要复杂得多。美国国家癌症研究所将癌症描述为一组相关疾病,已知类型超过 100 种。不同器官的肿瘤由不同细胞产生,受到不同基因、免疫环境和外界因素影响。即使病理名称相同,两名患者的突变组合和治疗反应也可能相差很远。

一名患者体内的肿瘤也不是整齐划一的细胞群。肿瘤在不断复制中积累突变,形成多个特征不同的亚群。一次活检取到的只是某个位置、某个时间的样本,未必包含所有具有转移或耐药能力的细胞。

更棘手的是,治疗还会改变肿瘤。药物杀死敏感细胞后,少数具有耐药性的细胞可能留下并扩张;免疫系统清除容易识别的细胞,也可能选择出更善于隐藏的亚群。2025 年 Nature Reviews Immunology 的一篇综述指出,肿瘤内部异质性与较差的临床结局、对免疫检查点抑制剂反应不足相关,免疫压力本身也会参与塑造肿瘤演化。

算法此时面对的不再是一道答案固定的识别题。模型根据过去患者的数据学习规律,新的药物和治疗组合却会改变疾病的选择环境。当诊疗方式发生变化,历史数据中的关系也可能随之失效。

癌症数据还存在一个看似矛盾的问题:医院和研究机构保存了海量影像、基因组和病历资料,但进入具体治疗决策后,可用样本迅速减少。

一旦按照癌症亚型、突变、治疗史、年龄、免疫状态和合并疾病继续划分,每组患者可能只剩很少几人。真正需要个体化治疗的罕见组合,恰好也是训练数据最稀缺的位置。记录方式不同、随访缺失、治疗选择偏差和人口代表性不足,还会继续削弱模型的可靠性。

AI 仍然可以在这里发挥作用。它能把病理图像、基因突变和临床资料放在一起分析,寻找单一数据源难以发现的患者亚群;能够预测潜在新抗原、优化放疗计划、匹配临床试验,也能帮助医生更早发现复发迹象。

这些工具提高的是观察、排序和决策能力。它们给出的治疗建议是否真正优于医生原来的选择,仍需要前瞻性研究;一项建议能否在不同医院、不同族群和不断变化的治疗环境中保持有效,则需要真实世界验证。

而当 AI 从识别疾病走向干预疾病,它就同时进入了因果关系、伦理责任和风险分配的领域。模型的一次错误分类可能导致重复检查;一次错误治疗建议可能让患者错过有效药物,或者承受不必要的毒性。越接近患者身体,证明责任就越重。

因此,在“治愈癌症”乃至其他普通疾病的道路上,AI 依然任重而道远。

成功之前的一切,正在加速

但话又说回来,AI 对医学的影响,未必需要等待第一款“完全由 AI 发明”的药物获批才算成立。

它已经改变研究人员阅读知识的速度,扩大了可搜索的分子和蛋白质空间,也开始介入实验设计、患者招募、临床数据分析和监管材料处理。

FDA 与欧洲药品管理局 2026 年共同发布的良好 AI 实践原则,把“明确使用场景”放在核心位置:模型是否可靠,取决于它被用来回答什么问题,以及答案将承担多大的风险。

这也提供了一种更有意义的衡量方式。在药物发现阶段,可以考察 AI 是否缩短了候选物设计和优化时间,是否提高了经过实验确认的命中率。在临床阶段,应当观察它能否减少试验失败、改善患者招募、找到真正获益的亚群。最终的标准仍然是患者是否活得更久、更健康,是否用更低成本获得了安全有效的治疗。

Rentosertib、Anthropic 的蛋白质设计和莫德纳的个体化疫苗,正在把 AI 推向这条链条的不同位置。它们比单纯的模型基准更接近生物世界,也比“AI 治愈癌症”复杂得多。

Dario 所说的陈词滥调,问题或许就在这里。它把一个仍在逐级验证的过程提前写成了结局,也让那些已经发生、却不够戏剧化的进展失去了准确的名字。

截至今天,AI 已经开始影响科学家下一步选择哪个靶点、设计哪个分子、进行哪项实验,而患者能否被治愈,仍要由实验、临床和时间共同回答。

参考资料:

1.https://www.cancer.gov/about-cancer/diagnosis-staging/prognosis

2.https://www.anthropic.com/research/Claude-accelerates-protein-design

3.https://substack.com/home/post/p-212025190

4.https://pmc.ncbi.nlm.nih.gov/articles/PMC9293739/

5.https://www.nature.com/articles/s41577-024-01111-8

6.https://www.fda.gov/news-events/press-announcements/fda-proposes-framework-advance-credibility-ai-models-used-drug-and-biological-product-submissions

运营/排版:何晨龙

注:封面/首图由 AI 辅助生成