中国科学技术大学的研究人员搭建了一套机器科学家实验平台,专门评估各类大语言模型在真实物理实验中的执行能力。

这项被称为“真实物理世界压力测试”的研究直接把AI拉到了实验室一线。不同于以往的基准测试,这次是在实际操作中检验AI能否真正接手科研任务。

打开网易新闻 查看精彩图片

结果相当骨感。研究发现,当前AI系统距离真正意义上的自主科学发现,还有明显差距。

实验室里的物理实验涉及设备操控、数据采集、异常判断等多重环节,任何一个环节掉链子,整个实验都可能跑偏。AI在模拟环境中表现不错的推理能力,放到真实物理世界中还不够用。

研究团队没有给出AI完全接管实验室的时间表,但从目前的测试结果来看,这条路比很多人想象的要长。