AI伪造史料,最近两年越来越多见。有人用AI生成一段仿古籍文字,配上编造的出处发到社交平台,评论区不少人直接当成真实史料讨论。不去仔细查证的话,根本察觉不到对应的典籍根本不存在。
识别这类伪造文本,有几个实用的判断思路。
第一点很直观,AI生成的史料,文字太过顺滑干净。真正的原始古籍,尤其是未经整理的版本,读起来门槛很高。里面包含大量生僻字、古代别称、典故隐语,还有很多默认读者知晓的时代背景。读一篇明代奏疏,光是理清人名、官职和事件背景,可能就要查阅多种文献。AI伪造史料完全不是这个质感,篇幅大多很短,一句话塞满全部关键信息,没有多余内容,读起来流畅得像现代人写的说明文。有人打比方,真实史料不会顾及阅读感受,阅读过程要费力钻研;AI伪造史料一味迎合读者,一眼就能看懂,这种特征本身就值得警惕。史料原本不是为了方便当代人阅读而写,不会刻意降低理解难度。

顺着这个思路,去核对标注的出处。AI伪造史料有明显的共性,列出的引用来源大多是二十四史、明清实录、《资治通鉴》这类知名度极高的典籍,作者也都是知名人物。偶尔编造书名,也只是对现有史料名称拼接改造。比如编造一段明朝使臣质问帖木儿不进贡的文字,配上看起来规范的注释,顺着注释检索,会发现这本书不存在,或是原文根本没有这句话。核对引文是最基础、有效的办法。打开中华古籍资源库,或是查阅《四库全书总目提要》《中国历史大辞典》,几分钟就能完成初步核验。
再看文风的一致性。真实历史文献有个特点,不同来源记载会交叉、冲突,存在主证和旁证的区别。同一件事,官方记载、私人笔记、地方志,说法往往各不相同,需要阅读者自行甄别可信度。AI伪造的内容没有这种层次感,多条所谓史料用词相近,观点完全统一,仿佛同一个人写好之后更换不同出处。这种高度整齐,本身就是破绽。真实史料是杂乱的,存在矛盾,记录之间互相冲突。
还有一类更隐蔽的漏洞,属于时代错位。AI生成历史文本,经常搞错时间线。有人做过测试,让AI生成杨嗣昌与崇祯的对话,AI写出来的内容里,杨嗣昌直接使用“大清”这个称呼。杨嗣昌死于1641年,当时清朝还没有入关,如果当着崇祯说出“大清”,后果会极其严重。类似错误还有溥仪称多尔衮为先父,二人相隔十几代。有学者尝试让AI模仿里耶秦简的文字,单纯文本层面,AI产出内容和出土简牍相似度很高,很难分辨。但一旦涉及时间节点、人物关系、称谓习惯,漏洞就会暴露。熟悉对应时代背景的人一眼就能发现,不了解相关历史的人,则需要检索核对。
维基百科编辑整理过一份AI写作特征清单,不少条目也可以用来鉴别假史料。AI写内容习惯强调主题重要性,频繁使用“关键时刻”“更广泛的运动”这类泛化表述填充内容。还偏爱用特定句式收尾,像“强调了某事的重要性”“反映了某个想法的持续相关性”。这类句式几乎不会出现在古代史料当中。除此之外,AI还喜欢加入带有主观渲染的描述,类似“风景如画”“令人惊叹”,语感和古文献完全不符。阅读时感觉违和,往往就是这类细节在提示问题。
核查参考文献还有个实操技巧。AI编造的参考文献,有时附带看起来正规的链接或者期刊名称,点开之后链接失效。研究者把这类链接分成两类,一类是曾经真实存在、现已失效的过期链接,另一类是从一开始就不存在的幻觉链接。针对古籍史料,如果标注了书名和卷次,去图书馆目录系统检索;如果是学术论文,就在知网或者JSTOR检索标题。检索不到时,不要怀疑是自己检索方式不对,大概率文献本身就是虚构的。
最后一条,也是最核心的判断标准:AI生成史料的目的不是客观记录,而是说服阅读者相信内容。大模型训练的核心能力,就是生成让人容易接受的回答,所以产出内容会不自觉追求戏剧效果,刻意制造看点。真实史料没有说服读者的义务,文字枯燥,前后矛盾,读完容易让人费解。阅读原始文献那种费力、需要反复比对梳理信息的疲惫感,恰恰是真实性的信号。AI不会让读者觉得费劲,只会不断迎合,让人轻易认同。




