8 月 29 日下午,中国仲裁周杭州场的圆桌上,轮到我讲 AI 幻觉。开讲之前,我先问了在座一个问题:大家还记不记得一部规章,叫《印章管理办法》?

台下不少人点头。然后我补了一句:这部规章,从来不存在。

主办方把“幻觉”从 AI 话题的大筐里单独切出来讨论,我才能在一个仲裁的场子里,当众把一组大多数人没印象的事实讲完。讲完之后觉得意犹未尽,整理成这篇文章。

一、一部不存在的规章,被引用了七年

先把事实摆清楚。以下基于公开报道。

据新京报今年 4 月的报道,从 2019 年起,全国 30 多家法院、检察院在印章启用公告里,陆续引用了一部名为《印章管理办法》的规章,作为启用印章、规范刻章行为的依据。这条引用链传播了七年。每一家单位发出的公告,都走完了本单位的三审三校。

今年 4 月,公安部在一份政府信息公开答复中明确:这个办法,从未出台。

去查现行有效的印章类规范,只有三部:1951 年的《印铸刻字业暂行管理规则》、1999 年国务院的印章管理规定、2025 年的《电子印章管理办法》。《印章管理办法》这个名字,只出现在 2002 年的一份草案和 2018 年的一轮征求意见稿里——两个都没走到实施。

一部不存在的规章,就这样在司法系统内部流通了七年。公开报道还提到,2020 年曾有法院在裁判文书中把它当作裁判依据采信。

二、第一个引用者为什么犯错

链条的第一环,大概率是这样的:某个起草者检索类案,或者参考兄弟单位的公告文本,看到对方援引了《印章管理办法》。他扫了一眼,格式规整,名称正经,文号齐全。心里过了一遍常识:我们国家怎么可能没有一部印章管理办法?

于是引用。没有去核验。

注意他犯错的姿势,不是“偷懒”两个字能概括的。他其实做了一个推理:“看起来像真的”,加上“符合常识预期”,等于“是真的”。这个推理的每一步,在他以往的经验里都运转良好——唯独缺了一道工序:回权威源核对。

三、后面的人为什么连锁犯错

更值得分析的是后面那三十多家。

他们的信息环境比第一个引用者更好:已经有“别的法院这么写”在先,重复引用的心理成本更低,核验的动力也更弱。起草的人想:别家法院都这么写,肯定没错。三审三校的每一审,看到的都是一个“已经存在了很久”的引用。审查机制防得住新冒出来的错误,防不住“看起来很旧”的错误。

这就是人类幻觉的制造机制:高频复制。一个说法被复制的次数越多,它看起来就越像真的。不是因为它被验证过,而是因为见过它的人够多。

四、把两件事放在一起看

现在把镜头切到 AI。

大模型生成了一段内容:逻辑结构清晰,格式规范,语气笃定。你读下来觉得“像那么回事”,就用进了文书。

这个过程,和上面引用幽灵规章的过程,底层逻辑有什么区别?

没有区别。都是“看起来对”加“符合预期”,等于“信了”;都缺同一道工序:回权威源核验。

再往深一层。很多人说 AI 的可怕之处在于它会幻觉。但注意一个事实:AI 生成的正确案例和错误案例,用的是同一套架构、同一种算法。那些与你的预期不匹配的,你叫它“幻觉”;匹配的,你叫它“答案”。区分它们的不是 AI,是你的预期。

而抛开 AI 不谈,人类历史上幻觉一直存在,《印章管理办法》只是最近的一个例子。幻觉不是 AI 发明的。

AI 改变的是三样东西:幻觉的生产成本,从“一次错误的复制”降到零;生产速度,从“一年传几家”提到秒级;生产规模,从“一个系统内部”变成“所有使用者”。旧的幻觉靠体制内的复制粘贴传播,一年感染几十家;新的幻觉,一次生成就能进入每个人的工作流。

五、比幻觉更麻烦的:幻觉的回流

《印章管理办法》这个案例里,还有一个细节值得单独拿出来说:它是靠什么完成七年传播的?

答案是:裁判文书本身。

第一个错误的引用进入裁判文书。裁判文书是公开的、权威的数据库。下一个检索者查到这里,看到的是“某法院在某份文书中援引了《印章管理办法》”,这比任何小道传闻都硬。于是引用链滚雪球,越滚越大。

这叫幻觉的回流:幻觉进入权威信源,权威信源反过来给幻觉背书。

这个闭环在 AI 时代会转得更快。AI 的检索库、训练语料里如果混入了带幻觉的文书,它会把幻觉当作“有出处的知识”输出给下一个用户,下一个用户的引用又成为新的语料。没有一道闸门,这个环不会自己断。

幻觉的回流闭环 一处错误引用 无人核验 进入裁判文书 公开 · 看似权威 被检索到 · 被引用 "有出处,应该靠谱" 滚雪球:七年 · 30 多家单位 权威源核验 断环的唯一闸门 闸门不在 AI 那一端——AI 不会自己发现、不会认错、也不会改 纠错的责任,只能锚在人身上

六、解药七十年没变过

那这个环怎么断?

回头看《印章管理办法》是怎么被终结的。不是哪一家法院自己醒悟,是一条纠错链在起作用:有法院系统内部的提醒,有公安部门在政府信息公开答复里白纸黑字写“从未出台”,有媒体把这件事报道出来。大家很小心地去查了查,原来真没有。问题解决。

注意这条纠错链上的每一环,都是人。提醒的人、答复的人、报道的人、去查证的人,每个动作背后都有主体性:有人对结果负责,有人会认错,有人能改。

这正是 AI 幻觉和人类幻觉最深的差别。AI 会生产幻觉,但它没有内生纠错链:它不会自己发现错误,不会认错,也不会改。它甚至会用同样的语气、同样的流畅度,把同一个错误再讲一遍。纠错的责任,从头到尾只能锚在人身上。

所以幻觉的解药,从 2019 年到今天,一个字都没变过:回到权威源。

引用规章,回权威法规库核对它存不存在;引用案例,回裁判文书库核对案号和内容;AI 给出的一切,当作一个看起来很专业的助理的口头意见,核完再用。别信语气,信源。这句规矩防 AI,也防人——毕竟《印章管理办法》告诉我们,人类的幻觉一旦制度化,比 AI 的还顽固。

七、变的只是造幻觉的速度

那天圆桌上我说,幻觉这个话题要拆细了聊才有意思。拆完之后的结论很朴素:AI 没有制造一种新罪行,它只是把一个古老的错误变得又快又便宜。对付古老错误的方法,人类早就有——让更权威的信源开口说话,然后自己去查一查。

方法没变,我们造幻觉的速度变了。所以纪律,得比过去更硬。


作者简介: 陈石律师(主页 chenshi.ai),浙江海泰律师事务所副主任、高级合伙人、房地产与建设工程部主任,宁波市律师协会副秘书长、第七届宁波仲裁委员会仲裁员,聚焦建筑房地产、投融资、并购重组及商事争议解决。曾获多家法律媒体与专业机构认可,荣登 LegalOne 2025 中国区建工及房地产实务先锋 45 强、律新社 2025 年度管理合伙人 20 佳(华东),入选《商法》The A-List 法律精英,获评 ALB China 区域市场十五佳长三角地区律师新星,并获律新社 2024 年度并购领域品牌之星。长期为万科、华润置地、信达地产、保利置业、招商蛇口、中海地产等企业提供法律服务,承办“首宗百亿地王”“长春第一高楼”“台州第一高楼”等代表性项目,累计服务项目投资额超千亿。近年来持续推动 AI 与法律实务融合,强调以结构化方法打通技术逻辑、法律判断与商业场景;著有《赋能法律人:AI 底层思维与应用范式》,并在多地开展相关主题讲座与分享。