文/孔奔看世界,欢迎转发
2026年8月份,日本小动作频繁。
首相高市早苗发表战败日讲话:距离上次大战结束已经过去 81 年,不经历战争的世代占据主流。绝不让战争的惨祸再次发生。无论岁月如何流逝,都要将这一坚定的誓言跨越世代传承,贯彻到底。
而2025年石破茂发言是这样的:战争的惨祸绝不能重演,前进的道路绝不能再次走错。那场战争的反省与教训,此刻必须再次深刻铭刻于心。
不难看出,高市早苗通篇里没有反省二字,她以自民党总裁身份向靖国神社供奉祭祀费并遥拜。
同一天,自民党干事长、总务会长、选举对策委员长在终战日一起走进靖国神社。执政党三名高层在这个日子集体参拜,是战后第一次。
也是同一天,日本政府正在建的行政辅助AI系统“源内”被披露接入了美国Anthropic公司的Claude系列大模型。注意这个系统的名字叫:源内。
日本数字厅文件显示,日本国会在2025财年补充预算中拨款44亿日元支持这套系统建设,2025年先在数字厅内部试点,2026年向大约18万名政府职员开放。它被写进高市早苗的AI战略,内阁官房长官木原稔以及经济安全保障担当大臣小野田纪美都在其中。
为了把系统撑起来,数字厅牵头收集了约1800万页政府数据,包括内阁决定、国会会议记录、白皮书。另外还收了官报,时间跨度接近80年。
这80年从哪一年算起,是整件事最该被追问的地方。
数字厅收集的官报,起点是1947年5月。代表日本投降的终战诏书发表于1945年8月。中间那近两年,留在了收集范围之外。
原来如此,这个AI系统叫源内,意思是源自内战,自欺欺人的自。
这明显是想搞事情啊。把训练语料的起点设在宪法施行日,等于把投降、受审、定罪这三年整个裁在数据之外,只留下和平宪法生效之后的那个日本。
被裁掉的这段时间不是空白。远东国际军事法庭1946年5月开庭,1948年11月宣判,判决书专章审结南京暴行。今年正好是东京审判开庭80周年。
一套政务系统收集本国近80年官方公报,却从法庭开庭前一年的宪法施行月起算?意思是这个AI模型在回答历史问题时能调用的官方文本是从1947年5月开始算的。
源内是做行政业务用的,它生成的内容会进政府报告、白皮书、政策文件。目前已有日本大臣承认,自己的国会答辩稿是用源内生成的。
一份AI写出来的文稿,挂上政府公开表态的标签,就拿到了语料世界里最高一级的可信度?
后面的传导不需要任何人再推一把。政府公开资料被爬虫抓走,被别的大模型当作高可信度来源纳入训练集,再经微调固化成默认回答。
等到有人问一句和日本历史有关的话,出来的答案已经带了滤镜。这就是日本对AI进行投毒的最终目的。
篡改教科书影响一代人。这条链条影响的是所有人以后查任何东西时拿到的第一个答案。
技术上这条路走不走得通,有一篇论文给了答案。
2026年4月,英国卡迪夫大学和西班牙巴斯克大学的研究者发了一篇预印本,标题就叫《为什么所有大语言模型都痴迷于日本文化》。他们建了一个叫CROQ的数据集,覆盖24种语言、11个大领域、66个子主题,一共31680个开放式文化问题。
问题的设计讲究在这里。不指定国家,只要求模型自己挑一个地区来答,比如当地的民间传说是怎么保存的,请自行选择地点。模型挑出来的地区,就是它内部认为最默认、最突出的那个。
测试对象是8个前沿模型,包括ChatGPT、Gemini、Claude、Llama、Command-r、Mistral、Qwen和DeepSeek。剔掉提问语言对应的母国之后,8个模型里有6个把日本列为被提及最多的国家。24种语言横着比,11个文化主题里日本拿下7个。美国第二,往后是印度、中国、法国。
研究者用OLMo这类公开了各阶段版本的模型做对照,比较基础模型和微调之后的差别。
结果呢?
基础模型的地理分布反而更均衡。而对日本和美国的集中度出现跳升,是发生在监督微调之后。
由此可见:AI的世界观不是从互联网原始数据里自然长出来的,是在人工调优这一步被写进去的。
现在日本政府要在这个已经偏向自己的环节上,主动往里加料。
日本《朝日新闻》做过调查,中国国家安全部7月26日发表评论文章《AI造不了真相 篡改洗不掉血痕》做了系统梳理。日本右翼势力通过诸多大型众包平台长期发招募广告,公开征集批判中国类视频。
发包方不只给需求,还配一份详细的操作指南。接单的人往AI软件里输几条指令,几分钟出一条南京大屠杀是谎言、日本善待平民这类内容。
价格是标出来的。一条30秒篡改侵华历史的AI视频报价5000日元。涉华负面内容每千次播放奖励1000日元,是普通视频的三倍以上。播放量达标另有奖金。
被曝出的招募页面写得毫不遮掩,要的是日本称赞系、技术系、中国批判系这类海外反应视频,单条2000到4000日元,还标明可以用AI生成图像、用工具合成AI配音和字幕。
低门槛加高回报,把大量分辨不出史实的创作者卷进来。这已经不是传统意义上的学术造假或文本篡改,是历史谎言的流水线生产。
钱从哪来?
日本外务省的公开预算数据写着。2015年,外务省新增一个重点预算类别,名为海外战略信息传播。按外务省相关文件的描述,这笔钱用于向国际社会宣传日本在领土完整、历史认识、积极和平贡献等方面的所谓正确形象,具体规划里包括培养亲日外国人、修改海外教科书中慰安妇的记载。
2015年到现在,这一项直接相关的工作事项总预算超过560亿日元。2025年单年就有62.2亿日元。由外务省管辖的日本国际交流基金会,被曝出连续多年资助外国学者和媒体人传播亲日内容。
日本政府战后对慰安妇问题所作的所谓补偿,总额不足百亿日元。花在洗白上的钱,是花在受害者身上的五倍以上。
2015年这个起点也不随机。那一年,中国第一次举办以纪念抗日战争胜利为主题的阅兵。
7月29日,中国外交部发言人毛宁在例行记者会上回应了这件事。她说,战后日本右翼势力非但没能深刻反省侵华历史,反而处心积虑歪曲事实真相、淡化历史罪责,通过参拜靖国神社、篡改教科书、修改纪念馆说明等方式散播错误历史观,严重误导日本社会,特别是青少年群体。
她接着说,如今右翼势力借助新型技术向舆论投毒,配合推动日本再军事化,其严重性和危害性更甚。这是对国际公理正义和战后国际秩序的公然挑衅,威胁地区和平稳定,国际社会必须高度警惕,坚决抵制。
发言人用投毒这个词,用得准。
这套舆论工程不独立存在,它有配套。
8月4日,日本防卫省公布2026年版《防卫白皮书》,首次单列新型作战方式章节,明确提出强化无人装备、AI军事运用和远程打击能力。白皮书连续两年把中国定位为日本前所未有的最大战略挑战。
2026财年日本防卫预算到9.04万亿日元,占GDP比重提前达到北约2%标准。防卫省已拟向财务省申请2027财年约8.9万亿日元,其中包含大量未明确金额的项目,最终规模可能到10万亿日元。
共同社报道说,这笔预算的投放重点除了进攻性武器装备的研发部署,还包括在指挥系统中引入人工智能技术。
对此《朝日新闻》质问,日本谋求对敌基地攻击能力、解禁杀伤性武器出口,这会向周边国家释放怎样的信号?
先把周边说成威胁,再把自己扩军说成不得不为,AI在这套叙事里是生产线。
Anthropic不是一家立场中性的技术供应商。这家公司官网列出的支持服务国家和地区名单里,中国大陆被排除在外,理由是所谓法律、监管与国家安全风险。同一份名单里,台湾被单独列出。
2025年9月,Anthropic进一步宣布Claude系列立即停止向中资控股企业提供服务,标准是直接或间接由中国实体持股超过50%,注册地在美国也照样封禁。
公司首席执行官达里奥·阿莫迪多次在公开场合把中国称为敌对国家。他主张对华严格管制先进芯片和芯片制造设备。
日本把政务AI的技术底座交给这样一家公司,这不是采购选择,是政治站位。
有个对照可以放在一起看。8月2日起,Anthropic为新版Claude在全球范围默认嵌入隐形水印,文件附加签名元数据,理由是履行欧盟《人工智能法案》的透明度条款。技术上它能给每一句生成文字打上可追溯的标记。至于喂进模型的立场是什么、被谁挑选、从哪一年算起,这套体系没有任何约束。
我的看法是:监管管住了内容从哪里来,但管不住内容里装了什么。
同一时间,现实里还发生了另一件事。
2026年5月14日,三个中学生凑了一万多元去哈尔滨。江苏连云港的徐凯睿15岁,浙江台州的杨宇轩15岁,河南的周犇16岁,三人因为共同的历史爱好在网上认识。
他们把三件史料无偿捐给了侵华日军第七三一部队罪证陈列馆,分别是《九六式马防毒面具取扱法案》、1855部队经济资料和1875部队经济资料。1855部队是侵华日军华北方面军防疫给水部,这批经费单据和收支记录,证明配合七三一部队开展细菌战一事真实存在。陈列馆鉴定为真,专门举行了捐赠仪式。
7月底,杨宇轩在网络平台收到死亡威胁。对方要求他删除相关史料视频,否则就开盒公开其家庭住址、学校和同学信息,还写下别逼我给你家销户。当他质问对方身份时,收到的是一段流利的日语。
他没有删视频。他公开回应说,历史不该被逃避,原件已经捐了,脑子里的备份删不掉,今后也不会停止收集史料。7月31日浙江台州警方正式立案并启动专项人身安全保护,江苏连云港警方行政立案,并依法传唤了一名外地嫌疑人。
三份纸质档案,招来了这样的围剿。
他们在怕什么?他们最怕这种原始一手档案,因为是实实在在的物证,他们没办法“投毒”。
中国这边的应对,走的不是封堵那条路。
全球最大开源社区Hugging Face发布的2026年春季报告显示,中国自研开源模型的下载量占该平台开源模型下载总量的41%,美国是36.5%,中国首次拉开差距,成为规模第一的开源模型供给方。
国务院总理李强今年6月在大连出席夏季达沃斯论坛时提到,中国人工智能开源大模型全球累计下载量已突破100亿次。
调用量的对比更直接。截至2026年7月26日,模型聚合平台OpenRouter近28天的全球调用份额,中国模型63.5%,美国模型35.5%。8月4日更新的周榜上,前五名全部来自中国团队,DeepSeek独占两席,第六名才是GPT-5.6 Luna。
加州大学伯克利分校教授Ion Stoica的判断是,中国开源模型与全球顶尖闭源模型的差距,已从6到9个月收缩到2到3个月。
成本这条更说明问题。肯尼亚一名创业者用中国开源模型开发法律文件检索系统,总成本约2.5万美元。同样的东西换成Anthropic的Claude,成本可能超过100万美元。
乌干达开发者形容这个差别,用中国模型像拥有自己的房子,用美国闭源模型像长期租房。
开源的意义是什么?权重公开就意味着可以查,语料构成可以审,默认答案不被一家公司和一种立场单方面锁定。
一个国家能不能守住自己的历史叙事,眼下要看两处,本国语料的完整度,和模型生态里的实际份额。
日本这些年的路径没怎么变过。教科书里把侵略淡化成进出,长崎原爆资料馆把大屠杀改称事件,靖国神社年年参拜,现在轮到了AI。
他们的目的是什么?其实是同一件事,把军国主义的侵略罪责从记录里洗掉,给扩军备战腾出社会空间。
日本费尽心机搞这些小动作,我们中国人早就看穿了。
1948年11月,远东国际军事法庭的判决书用专章审结了南京暴行。2015年,《南京大屠杀档案》列入联合国教科文组织《世界记忆名录》。侵华日军南京大屠杀遇难同胞纪念馆现存文物19.2万余件。拉贝日记、魏特琳日记、马吉影像、幸存者证言,人证物证都在。
也就是说,日本的源内AI模型,只能扭曲事实,但无法改变事实。
挺可笑的,日本连自己的历史都不敢承认,只能在自欺欺人的道路上越走越远。
到头来,所有处心积虑的小动作,都将是竹篮打水一场空。
热门跟贴