九一八事变过去95年后,日本对历史叙事的争夺,已经悄悄从教科书、纪念馆和电视节目,进入了搜索引擎和人工智能。
近日,有博主分别使用日语和英语,向ChatGPT、Gemini、Grok、Perplexity等多款大模型询问二战历史问题。
结果令人警惕。
部分模型在回答日本侵略责任时措辞含糊,将已经有明确历史结论的侵略行为描述成“地区冲突”或“存在不同观点的问题”。还有模型在被要求补充中国方面的资料时,反过来询问用户是否不希望采用中国信源。
如果只是一款模型答错了,可以归结为幻觉或者训练偏差。但多款模型面对相近问题,都不同程度地淡化日本的侵略责任,这就不能只用一句“人工智能不可靠”来解释了。
因为大模型不会凭空创造历史。它给出的答案,要么来自训练语料,要么来自搜索引擎、数据库和数字档案。
谁的资料多,谁的资料更容易被机器抓取,谁就更有可能成为人工智能回答历史问题时的默认来源。
而日本显然已经注意到了这一点。
今年3月23日,日本国立公文书馆下属的亚洲历史资料中心,正式启用更新后的数据库系统。
这个中心收录的不是普通网络文章,而是来自日本国立公文书馆、外务省外交史料馆、防卫省防卫研究所战史研究中心的大量近现代历史资料,其中相当一部分直接涉及日本对外扩张和侵略战争。
日本方面自己在数据库更新公告中写得很清楚:新系统将定期更新网站地图,让整个数据库不仅更容易被谷歌等搜索引擎抓取,也更容易被近年来广泛使用的生成式人工智能参照。
他们下一步还准备研究AI搜索、自动翻译、目 录信息多语种化以及AI文字识别,把原本以图片形式保存的历史档案转化为机器可以搜索、分析和调用的文字。
表面上看,这只是一家档案机构改造网站,提高检索效率。
但把这件事放到人工智能时代来看,分量就完全不一样了。
过去,日本想要在国际上修改侵略历史,需要修改教科书,需要右翼政客公开发言,需要拍摄影视作品,还要想办法把这些内容传播出去。
现在有了人工智能,传播路径变短了。
先把档案重新整理,给它编写目录和说明文字。再把这些目录翻译成英文,开放给搜索引擎抓取——最后让生成式人工智能能够直接找到和引用。
三步走完,一套由日本官方机构整理的历史材料,就可能绕过传统媒体,直接出现在全球用户的问答界面里。
这才是最值得警惕的地方。
对于普通研究者来说,还可以打开原始档案,联系前后材料,判断目录是否准确。
但大模型往往没有这个耐心。它在几秒钟内拼接答案,更依赖已经整理好的目录、摘要和网页说明。
谁把资料加工得更适合机器读取,机器就更容易先看到谁。
日本亚洲历史资料中心这次更新,恰恰是在打通这条通道。其“2030愿景”还提出,要继续扩大英文目录数据以及与海外数字档案的连接,让更多海外用户利用这些资料。
这意味着,日本正在把自己的官方档案体系,主动接入全球人工智能的信息入口。
近年来,日本右翼不断淡化南京大屠杀、强征劳工和“慰安妇”问题,把殖民统治包装成所谓“现代化”,把侵略战争描述成日本为了“自存自卫”而采取的行动。
他们最擅长的,并不是把所有罪行全部删除。那样太粗糙,也很容易被识破。
他们更常见的做法,是承认发生过战争,却不承认战争性质,故意把已经明确的事实重新放回“各有说法”的框架里。
过去这种话术主要影响日本国内。
如今一旦相关目录和解释被人工智能大规模调用,影响的就可能是全世界。
今天的年轻人遇到陌生问题,究竟还有多少人会一本一本翻阅档案和学术著作?
更多人的第一反应,是打开搜索引擎,或者直接问人工智能。
人工智能给出的第一段回答,很可能就会成为他们理解这段历史的基本框架。之后即使再看到不同材料,也会下意识地围绕这个框架进行判断。
这就是所谓的入口优势。
日本只要让机器在回答关键历史问题时,多说一句“存在争议”,少说一句“侵略责任”,目的就已经达到了一半。
而且,人工智能通常使用一种平静、克制、看似中立的语气。
同样一句歪曲历史的话,从右翼政客嘴里说出来,很多人会本能警惕,从人工智能嘴里说出来,却容易被当成客观结论。
机器的语气越冷静,错误观点的欺骗性反而越强。
所以今天纪念九一八,不能只盯着日本政客有没有参拜靖国神社,也不能只注意日本教科书又删除了什么内容。
新的战场,已经转移到了数据库、搜索权重和模型答案里。
中国和其他亚洲受害国家手中并不缺少历史资料。关于南京大屠杀、“慰安妇”、强征劳工、细菌战以及殖民统治,大量原始档案、幸存者证言和国际法律文件都保存了下来。
真正的问题是,这些材料有多少完成了高质量数字化?有多少建立了准确的英文、日文目录?又有多少能够被全球搜索引擎和人工智能稳定找到?
如果我们的史料还散落在扫描图片、纸质文献和彼此隔离的数据库里,日本方面却已经把自己的材料整理成适合机器读取的形式,那么人工智能在搜索时会先看到谁,答案并不难猜。
我们绝不能让真实历史在进入机器之前,就输在资料整理和传播能力上。
中国需要建立面向人工智能的历史资料体系,把原始档案、学术研究、受害者证言与国际法文件连接起来,形成能够检索、验证和相互引用的多语种资料链。
人工智能时代的历史话语权,最终比拼的不只是观点,更是资料、技术和入口。
日本已经开始给机器准备材料了。如果我们还把这当成一次普通的网站升级,恐怕迟早要吃亏。
坚决不能让右翼历史观以这种更加安静的传播方式。
否则未来年轻人再问机器九一八意味着什么,就未必由我们决定了。
#九一八事变爆发95周年##见证“勿忘九一八”撞钟鸣警仪式#
热门跟贴