AI已经走进了你的办公室、你孩子的教室以及法庭。现在,该轮到它进军医院了。

最近,哈佛医学院和贝斯以色列女执事医疗中心的医生、计算机科学家组成团队做了一项研究,把OpenAI的o1-preview在急诊室的诊断结果,和两位内科主治医师的诊断结果进行了对比。

然后,另外两位主治医师对这两组诊断进行评估,他们事先不知道哪些结果来自人类,哪些来自AI。结果显示,AI的诊断更胜一筹。

“我们几乎用所有基准测试了AI模型,结果它不但超过以前的模型,也比医生们的表现还好,”这项研究的资深共同作者、哈佛大学布拉瓦特尼克研究所的生物医学信息学助理教授阿尔琼·曼莱在一份声明中表示。

人工智能已经开始重塑医疗领域。谷歌 DeepMind 的 AlphaFold 正在推动生物研究。一些急诊室已经部署了生成式 AI 来做笔记、写病历。而在犹他州,一个 AI 系统甚至在没有医生参与的情况下给病人开药(尽管医生们指出这可能会让病人有风险)。

哈佛大学的这项研究再次证明,AI 模型越来越能做医疗行业里的关键工作了,结果甚至让研究者自己都吃了一惊。

“我本来以为就是个有趣的实验,不会太管用。结果完全不是那么回事,”这项研究的资深作者、在贝斯以色列医院工作的亚当·罗德曼医生在一份声明中表示。

人工智能如何重塑医学

人工智能如何重塑医学

这项研究的发现尤其令人震惊,因为与以往的人工智能医学研究不同,研究人员没有对数据进行清理。每个病例都是电子健康记录里原样呈现的,一点没动过。

该研究的合著者彼得·布罗德是哈佛医学院在贝斯以色列女执事医疗中心的临床研究员,他发声明说,AI模型现在是越来越厉害了。

“我们过去用选择题来评估模型;现在它们一直能拿接近100分,我们已经看不到进步的空间了,因为模型水平已经到顶了,”他说。

当然,研究人员指出,这些结果并不意味着人工智能已经足以取代医生。布罗德尔表示,虽然人工智能擅长诊断,但它往往会建议一些不必要的检查,这其实可能弊大于利。

但人工智能正在影响医生的决策。在去年12月发表的另一项研究中,一个研究团队发现,67%的医生最初不建议对患者进行治疗,但在AI提出相反建议后改变了决定。

罗德曼告诉《卫报》,即便如此,目前关于AI诊断还没有正式的问责框架,这项技术也尚未赢得患者的信任。

患者仍然“希望有人类来帮他们做关乎生死的决定,并引导他们面对艰难的治疗选择”,他说。