AI 给的案号和法条是编的怎么办?怎么核验引用真假
AI 在法律问题上编造引用有三种典型形态:案号格式正确但这个案子不存在;法条序号真实但内容张冠李戴;法条内容大致对但引的是已被修改的旧版本。这三种都无法靠「读起来是否通顺」识别,只能逐条回到原文核对。可操作的核验方法是:把每一条引用拆成案号或法条序号、出处、原文三部分,逐条去权威来源查原文,对不上的一律删掉而不是改写。工具侧也有一条设计原则能从源头减少伪造——引用必须取自读取原文的返回结果,检索摘要只用于判断该不该打开,不能直接当引文使用。把摘要当引文,是模型生成伪造引用最主要的途径。
操作流程
- 把引用逐条拆出来先把 AI 输出里的每一处案号、法条序号、裁判要旨单独列出来。混在行文里核对必然漏。
- 先查存在性案号是否真实存在、法条序号在该法里是否存在。这一步能筛掉大部分凭空捏造的引用。
- 再查内容一致性打开原文,核对引用的内容与原文是否一致。序号对而内容错,是比凭空捏造更隐蔽的一类。
- 最后查版本与时效法条要确认是不是现行版本、是不是事实发生当时适用的版本。内容对但版本错,同样不能用。
- 对不上就删,不要改写核不出来的引用直接删除。把一个可疑引用改写成看起来更可信的样子,风险只会更大。
注意事项
- 越是具体、越是看起来专业的引用,越需要核验。编造的引用往往格式比真实引用更规整。
- 要求 AI「只引用真实存在的案例」不能解决问题。模型无法自知哪些是编的,这类要求只会让它输出得更自信。
- 带链接的引用也要点开看。链接可用不代表链接指向的内容支持这段论述。
- 核验责任在使用者。无论借助什么工具,写进文书的每一条引用都由署名的人负责。
律社在这一步做了什么
律社在这一点上的做法是:引用一律取自读取原文的返回结果,检索摘录不作为引文来源,摘要只用于判断该不该打开。系统支持 Word 段落、PDF 页区域、音频时间范围三类原文锚点,每条引用都能回到原始位置核对,并可查看读取回执与过程回放。另配有离线的引用核验流程,可在样本内识别真实引用、伪造引用与漏引。需要说明边界:该流程校验的是引用与原文是否对应,不是对论述本身作事实正确性评测。
常见问题
AI 编造法律引用有哪几种形态?
三种:案号格式正确但案件不存在;法条序号真实但内容张冠李戴;内容大致正确但引的是已被修改的旧版本。第三种最隐蔽,因为条文本身确实存在过。
为什么检索摘要不能直接当引文?
摘要是为了帮你判断该不该打开原文而生成的,它本身经过压缩和改写。把摘要当引文,等于把二手转述当成原文引用,这是伪造引用最主要的来源。正确做法是摘要只用于导航,引文取自原文。
能不能让 AI 自己检查有没有编造引用?
不能作为唯一手段。模型无法可靠识别自己哪些输出是编的。可行的是让系统在架构上限制引用只能来自原文读取结果,再配合人工逐条核对。