日本开始给AI“喂历史”,以后年轻人问918,机器会替谁说话?

九一八事变过去 95 年了,你以为历史已经盖棺定论?别天真了。日本对历史叙事的争夺,早就从教科书、纪念馆和电视节目,悄悄转移到了你天天搜的搜索引擎和人工智能里。

前几天,有博主分别用日语和英语,问了 ChatGPT、Gemini、Grok、Perplexity 等几款主流大模型同一个问题:二战期间日本有没有侵略责任?结果让人后背发凉。部分模型回答时措辞含糊,把已经铁板钉钉的侵略行为,描述成 “地区冲突” 或 “存在不同观点的问题”。更离谱的是,有一款模型在被要求补充中国方面的资料时,反过来问用户:你是不是不希望采用中国信源?

如果只是一款模型答错了,我们还能说是 “幻觉” 或者训练偏差。但多款模型面对相似问题,都不同程度地淡化日本的侵略责任 —— 这就不是一句 “人工智能不可靠” 能解释的了。大模型不会凭空创造历史,它给出的答案,要么来自训练语料,要么来自搜索引擎、数据库和数字档案。谁的资料多,谁的资料更容易被机器抓取,谁就更有可能成为人工智能回答历史问题时的默认来源。

而日本,显然早就看准了这一点。

今年 3 月 23 日,日本国立公文书馆下属的亚洲历史资料中心,悄悄更新了数据库系统。这个中心收录的不是普通网络文章,而是来自日本国立公文书馆、外务省外交史料馆、防卫省防卫研究所战史研究中心的大量近现代历史资料,其中相当一部分直接涉及日本对外扩张和侵略战争。日本人自己在数据库更新公告里写得很直白:新系统将定期更新网站地图,让整个数据库不仅更容易被谷歌等搜索引擎抓取,也更容易被生成式人工智能参照。他们下一步还要研究 AI 搜索、自动翻译、目录信息多语种化以及 AI 文字识别 —— 把原本以图片形式保存的历史档案,转化成机器可以搜索、分析和调用的文字。

表面上看,这只是档案机构的一次网站改造,提高检索效率。但放在今天这个人工智能时代,分量完全不一样了。

过去,日本想在国际上修改侵略历史,得修改教科书、让右翼政客公开发言、拍影视作品,再想办法把这些内容传播出去。流程长、成本高,还容易被发现。现在有了人工智能,传播路径直接被压缩了:先把档案重新整理,编写目录和说明文字;再把目录翻译成英文,开放给搜索引擎抓取;最后让生成式人工智能能够直接找到和引用。三步走完,一套由日本官方机构整理的历史材料,就可能绕过传统媒体,直接出现在全球用户的问答界面里。

这才是最值得警惕的地方。

对普通研究者来说,还能打开原始档案,联系前后材料,判断目录是否准确。但大模型没有这个耐心 —— 它几秒钟内拼接答案,谁把资料加工得更适合机器读取,机器就先看到谁。日本亚洲历史资料中心这次更新,恰恰是在打通这条通道。其 “2030 愿景” 甚至提出,要继续扩大英文目录数据以及与海外数字档案的连接,让更多海外用户利用这些资料。这意味着,日本正在把自己的官方档案体系,主动接入全球人工智能的信息入口。

这些年,日本右翼不断淡化南京大屠杀、强征劳工和 “慰安妇” 问题,把殖民统治包装成所谓 “现代化”,把侵略战争描述成日本为了 “自存自卫” 而采取的行动。他们最擅长的,并不是把所有罪行全部删除 —— 那样太粗糙,很容易被识破。他们更常见的做法,是承认发生过战争,却不承认战争性质,故意把已经明确的事实重新放回 “各有说法” 的框架里。过去这种话术主要影响日本国内;如今一旦相关目录和解释被人工智能大规模调用,影响的就是全世界。

今天的年轻人遇到陌生问题,还有多少人会一本一本翻阅档案和学术著作?更多人的第一反应,是打开搜索引擎,或者直接问人工智能。人工智能给出的第一段回答,很可能就是他们理解这段历史的基本框架。之后即使再看到不同材料,也会下意识地围绕这个框架进行判断 —— 这就是所谓的 “入口优势”。日本只要让机器在回答关键历史问题时,多说一句 “存在争议”,少说一句 “侵略责任”,目的就已经达到了一半。

而且,人工智能通常使用一种平静、克制、看似中立的语气。同样一句歪曲历史的话,从右翼政客嘴里说出来,很多人会本能警惕;从人工智能嘴里说出来,却容易被当成客观结论。机器的语气越冷静,错误观点的欺骗性反而越强。

所以今天纪念九一八,不能只盯着日本政客有没有参拜靖国神社,也不能只注意日本教科书又删除了什么内容。新的战场,已经转移到了数据库、搜索权重和模型答案里。

中国和其他亚洲受害国家手中并不缺少历史资料。关于南京大屠杀、“慰安妇”、强征劳工、细菌战以及殖民统治,有大量原始档案、幸存者证言和国际法律文件保存了下来。真正的问题是 —— 这些材料有多少完成了高质量数字化?有多少建立了准确的英文、日文目录?又有多少能够被全球搜索引擎和人工智能稳定找到?

如果我们的史料还散落在扫描图片、纸质文献和彼此隔离的数据库里,日本方面却已经把自己的材料整理成适合机器读取的形式,那么人工智能在搜索时会先看到谁,答案并不难猜。我们绝不能让真实历史在进入机器之前,就输在资料整理和传播能力上。

中国需要建立面向人工智能的历史资料体系,把原始档案、学术研究、受害者证言与国际法文件连接起来,形成能够检索、验证和相互引用的多语种资料链。人工智能时代的历史话语权,最终比拼的不只是观点,更是资料、技术和入口。

日本已经开始给机器准备材料了。如果我们还把这当成一次普通的网站升级,恐怕迟早要吃亏。坚决不能让右翼历史观以这种更加安静的方式传播 —— 否则,未来年轻人再问机器 “九一八意味着什么”,就未必由我们决定了。

你认为,我们该怎么做,才能挡住这场 “安静的历史篡改”?评论区说说你的想法。

展开阅读全文

更新时间:2026-09-21

标签:科技   日本   年轻人   机器   历史   人工智能   档案   模型   资料   目录   右翼   搜索引擎

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight All Rights Reserved.
Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号

Top