一篇论文说自己造出了会飞的机器,可别人照着图纸做出来的却飞不起来——你会怎么看这篇论文?
眼下的量子计算领域,差不多就摊上了这么件尴尬事。德国雷根斯堡应用技术大学的一组研究者把近几年的量子论文翻了个底朝天,得出的结论直白得刺耳:绝大多数量子计算成果,别人根本没法照着做出同样的结果。
这份题为《Works on My QPU》的分析报告,最早挂在预印本网站arXiv上,随后又更新过版本。领头人是沃尔夫冈·毛雷尔,合作者还有拉尔夫·拉姆绍尔等几位同行。名字听着拗口,翻译过来大意是——"在我的量子芯片上跑得起来",一句略带自嘲的行话。
他们的做法分两层。人工那一层,挑了127篇有代表性的量子计算论文一篇篇仔细看;机器那一层,靠自动程序把范围扩到了近五千篇。评价的尺子一共五把,看的都是最基本的东西:代码有没有?说明白不白?硬件写清楚没?程序能不能真跑起来?
数据不太好看。人工审的这批论文里,愿意把代码亮出来的只有大约四分之一。听着已经不高了,更让人无奈的是——把这些代码拉下来实际去跑,超过六成直接卡壳、报错、跑不出结果。
自动扫描那近五千篇的结果也差不多,能凑齐"让别人有条件重做一遍"所需信息的,四篇里挑不出一篇。这个比例放在传统计算机科学里,是相当难看的成绩单。
毛雷尔自己承认,几年前他也带人做过一次小样本的类似统计,那会儿情况就不乐观。原以为过了这么久,同行们会自觉把家底晒得更清楚一些,结果几乎没往前挪。
那问题究竟卡在哪儿?
得先说说量子机器这东西的脾气。普通电脑不管搁在哪个大楼里、用哪一年生产的型号,同一段程序跑出来的结果就是一样的。量子设备完全是另一路子——冷得跟深空差不多的低温环境、时刻在颤动的量子比特、外界一丁点电磁扰动都会记账。
大部分研究者压根没有自己的量子机,都是掏钱租云端服务,用IBM、谷歌、IonQ这些厂家的机器远程算。人家的机器每天在做校准、在打补丁、在换硬件,昨天跑出来的数据,今天再来一遍未必对得上。
毛雷尔说了句挺公道的话——不能把这笔账全算到写论文的人头上。机器本身就"神经质",作者哪怕把代码打包得再仔细,硬件那头一变脸,实验照样重复不了。
圈里人对这份报告的反应有意思,并不是一边倒的紧张。
在Unitary Foundation做研究的威廉·曾说,看到这数据他一点都不惊讶。量子软件他形容成"活物",得有一群人天天喂它、修它,才能长期保持能用的状态。他还看好人工智能——现在的AI助手已经能从论文文字里反向拼出可运行的代码,未来这道坎或许没那么难迈。
芝加哥大学的弗雷德·钟态度更松弛一些。他觉得这行当还在婴儿期,各种技术路线都在打架,超导的、离子阱的、光量子的、中性原子的,谁也说不准谁能笑到最后。这时候硬要每个人按同一套模板交作业,可能反倒把新点子给憋死了。
他举了个类比:传统计算机科学也是花了差不多半个世纪,才慢慢养成"论文附代码"的行规。年轻学科总得有个学规矩的过程。
这话有几分道理,但也不能完全当挡箭牌。研究团队的拉姆绍尔透露,报告发出去之后,来找他们聊天的同行不少,大家心里都清楚——再这么糊涂账下去,早晚要出事。
出事的先例,其实并不遥远。
十几年前心理学界闹过一场闻名科学界的"复现危机",一批教科书级的经典实验被重做一遍,好些根本得不出原来的结论,整个学科的公信力被打得七零八落,之后才逼出预注册、原始数据公开这些改革。癌症生物学、社会科学也都摔过类似的跟头。
量子计算今天遇上的,本质是同一个问题,只是换了个更时髦的舞台。
而这个舞台上的钱和话题都不小。谷歌前不久还在宣传自家Willow芯片的进展,IBM亮出了千比特级别的路线图,国内的本源量子、国盾量子也各自有布局,欧盟、美国、中国的国家级投入加起来是天文数字。要是底下这些论文有相当一部分经不起复核,那市场的热度和实验室的真实进度之间,就存在一条被忽略的裂缝。
好在这份报告不光是挑毛病。毛雷尔他们顺手给同行留了套操作方案——建议在设计实验之初就想好数据怎么存、环境怎么打包、硬件参数怎么记录,甚至给出了一份可以直接照抄的模板。
说到底,这件事不是要给量子计算泼冷水,而是提醒外界:热闹归热闹,规矩得一条条立起来。哪天量子论文能做到"别人照着跑一遍能得出同样结果"是常态,这个领域才算真正长大成人。
在此之前,看到新的"量子突破"新闻时,不妨多留一分谨慎。风口上的东西,飞得高,也容易摔得响。
热门跟贴