AI 规范库最危险的错误,是引用了已经废止的版本
一个 AI 回答了规范问题,给出了标准号、条文号和具体参数。
表面看,这比只给一段没有依据的结论可靠得多。
但还差一个问题:它引用的,是现行版本吗?
如果答案来自一本已经废止的规范,文字识别得再准,条文号对得再整齐,也不能直接支撑当前工程结论。
这类错误比“没找到条文”更危险。
没找到,使用者知道要继续查。引用了旧版条文,答案却可能同时具有“有依据”“有数字”“能回源”的外观,更容易被当成正式依据使用。
一旦这段回答被复制进标书、施工方案、计算书或合规报告,问题就不再只是“模型答错了一次”。它可能变成返工、评审退回、错误决策,最后还要由企业里真实的人承担责任。
所以,一把手真正要判断的不是知识库收了多少本规范,也不是模型能不能答出条文号,而是:企业是否允许一条未经版本核对的依据进入正式工作。

一个真实的版本切换:JGJ 46-2005 与 JGJ/T 46-2024
临时用电是施工方案、技术标和现场安全管理中的常见主题。规范库中也很容易同时出现新旧两个版本。
住房城乡建设部 2024 年第 152 号公告明确,《建筑与市政工程施工现场临时用电安全技术标准》编号为 JGJ/T 46-2024,自 2025 年 1 月 1 日起实施。公告同时明确,原《施工现场临时用电安全技术规范》JGJ 46-2005 同时废止。
在 2026 年 7 月 17 日核对的 ArchSight 规范资产库中,这个关系被明确记录为:
- JGJ 46-2005 的
effective_status为superseded; - 它的
replaced_by指向 JGJ/T 46-2024; import_policy为do_not_import;- 阻断原因为
superseded_by_JGJT46-2024。
旧版本没有被删掉。它仍可用于历史项目追溯、版本差异比较和原文对照。
但它不应继续进入面向当前项目的检索、写作支持和合规判断链路。
这个区别很重要:保留历史资产,不等于允许它参与现行结论。
为什么 AI 很容易引到旧版本
一本规范被废止,不代表它会从互联网和企业文档中消失。
旧 PDF、培训课件、施工方案、博客和下载站仍会持续引用它。而且,旧版本往往积累了更多可搜索文本、解读文章和问答内容。
对只依赖相似度排序的 AI 检索来说,“资料更多”很可能被误当成“依据更强”。
还有几种常见的失真路径。
1. 切片时丢了封面和状态
规范被切分为条文后,每个片段可能只剩条文号和正文。标准号、年份、实施日期、废止状态和替代关系没有跟着切片走。
检索可以找到一段完整原文,却无法告诉使用者它属于哪个版本。
2. 上传 PDF 被默认当成现行文件
很多企业知识库关心“文件是否已索引”,却不管“它现在是否还能用”。
一旦上传成功,新旧版本都进入同一个检索池。如果没有导入阻断策略,废止文件仍会被正常召回。
3. “有页码”被误当成“已审核”
页码很有价值。它让工程师能从 AI 的回答跳回源 PDF,查看条文上下文、表格、公式和附注。
但页码只是回源线索。它不能证明 OCR 没有错,不能证明表格没有串列,也不能证明这一条适用于当前项目。
4. 只存文本,不存替代关系
如果数据库只有“标准号 + 条文”,它就无法稳定回答:
- 这本规范现在是否有效?
- 它被哪个版本替代?
- 新标准什么时候实施?
- 这次状态确认来自哪个官方公告?
- 状态最近一次是什么时候核对的?
这些信息不应由 LLM 临时凭记忆补齐。它们应该是规范库中可查询、可更新的一等数据。
规范库不能只存“内容”
一个能进入真实工作的规范库,至少要同时管理五类信息。
| 信息类型 | 至少要记录什么 | 解决什么问题 |
| --- | --- | --- |
| 身份 | 标准号、标题、版本、适用地区 | 避免同名、改名和年份混淆 |
| 状态 | 现行、部分废止、已废止、实施日期 | 决定能否用于当前项目 |
| 关系 | replaces、replaced_by、被废止条款 | 建立新旧版本和局部废止的链路 |
| 证据 | 官方来源、来源时间、文件 hash、回源页码 | 让状态和内容可复查 |
| 治理 | 导入策略、允许用途、审核状态、阻断原因 | 阻止候选资料越级进入生产 |
这些字段不是为了让数据库看起来更专业。
这些字段要参与检索和导入决策。当 effective_status=superseded 或 import_policy=do_not_import 时,系统应当在召回前阻断,而不是先让 AI 看到,再期待它在回答里自觉忽略。

进入生产之前,要过四道门
在规范数字化流程中,“成功”两个字常被用得太早。
文件导出成功,不代表内容已审核。
严格审计通过,不代表每个条文、表格和公式都已正确。
候选数据能被下游消费,也不代表它可以执行自动合规判断。
我们在 ArchSight 规范资产流程中把它们拆成四道门。
第一道:状态核对门
先确认标准身份、实施日期、现行状态和替代关系,并把结论锚定到官方来源。
状态不明时,系统只能返回“待核对”。它不能因为找到了全文,就默认这本规范仍然有效。
第二道:候选导出门
compliance-export 把文件化规范资产整理成目录、条文和证据候选 JSONL,便于下游平台导入和审查。
这是数据交接,不是专家审批。
对 do_not_import 的规范,导出目录可以保留它的存在、状态和历史证据,但不能给它分配当前使用场景。
第三道:一致性审计门
review-audit --strict 和 promotion-audit --strict 检查的是治理状态有没有自相矛盾。
例如,已经标记 do_not_import 的规范,是否还泄漏了 allowed_use 或场景包;尚未提升的规范,是否误暴露了 rule_candidate;核验队列、目录和审查台账是否对得上。
它们很重要。但它们的绿灯只能证明已定义的状态和阻断规则没有发现硬违规。
绿灯不等于专家读完了整本规范。
第四道:内容提升门
条文要从“检索候选”进入可执行的规则或正式合规判断,需要更严格的证据。
这通常包括:
- 原 PDF 和官方状态来源已核对;
- 条文、表格、公式和单位已复核;
- 适用条件和项目变量已建模;
- 与其他现行标准的边界和冲突已检查;
- 专业人员已完成审核并记录责任。
这才是 promotion 要管的事。
现行版本,也不等于可以直接自动判定
将 JGJ 46-2005 阻断之后,不是把 JGJ/T 46-2024 接上去就结束了。
在当前 ArchSight 规范资产库中,JGJ/T 46-2024 已记录为现行,也有住房城乡建设部公告作为状态来源。它可以作为检索、人工复核清单和写作支持的低置信候选。
同时,它的资产成熟度仍是 L2,review_status=pending,curation_status=flagged_for_review。当前交接清单中,剩余表格、类表格图片、强制性措辞、项目条件、跨标准边界和专家审批等门禁仍未完成。
因此,这个现行版本目前不允许成为自动临电合规检查、阈值计算器或项目条件模型的规则来源。
现行性回答“这本标准现在有效吗”。
内容审核回答“这一条数字化得对吗”。
适用性审核回答“它能用在这个项目上吗”。
三个问题不能互相代替。
一把手要做的,不是再换一个模型
旧版本进入答案,表面上是检索问题,实质上是治理责任没有落到人。
至少要明确四类责任:
| 责任角色 | 最少要负责什么 | 必须阻断的情况 | | --- | --- | --- | | 资料负责人 | 维护标准身份、版本、来源和替代关系 | 状态无来源、版本无法确认 | | 专业负责人 | 审核条文内容、适用条件和专业边界 | 内容未复核、项目条件不明 | | 系统负责人 | 把阻断规则落实到导入、索引、召回和提升流程 | 废止版仍能进入当前项目答案 | | 交付负责人 | 在标书、方案、计算书或报告发布前核对引用清单 | 引用缺少完整版本、状态和复核记录 |
这四个角色可以由不同的人承担,也可以在小团队里合并。但责任不能消失,更不能全部推给模型。
企业也不必一开始就治理全部规范。更稳的做法是先选一个高频专业、一个真实交付流程和一批高影响规范,跑通最窄试点。
试点是否可以继续,不看演示效果,看四个指标:
- 已知废止版本在测试集中的阻断率是否达到 100%;
- 正式答案是否 100% 显示完整版本和状态来源;
- 状态不明的资料进入正式结论的数量是否为 0;
- 每条正式引用是否都能找到责任人和复核记录。
这些指标没有达到,就不应扩大规范范围,也不应把系统接入更多正式交付流程。
给企业 AI 规范库的六项上线检查
如果你的团队已经上传了一批规范 PDF,可以先不谈复杂技术架构,直接做六项检查。
其中任何一项无法回答,都应该先暂停生产用途,而不是带着问题上线。
1. 新旧版本能否共存,却不会混用
用一本明确已废止的规范测试检索。看系统是会阻断现行项目用途,还是仍然把它排在最前面。
2. 回答是否总是显示完整版本
不要只显示规范名称。至少显示标准号、年份、现行状态、实施日期、条文号和回源页码。
3. 状态证据能否回到官方来源
对“现行”“废止”“部分废止”这类高影响状态,保留官方公告、目录或标准管理系统的来源地址和核对时间。
4. 废止版本是否在召回前被阻断
阻断不能只写在运维备注里。它要进入导入器、索引、场景包和规则提升的程序判断。
5. 系统能否明确说“不确定”
查不到官方状态,就应当返回待核对,而不是默认现行。只找到第三方全文,也不应把它包装成官方源。
6. 发布前能否完成人工版本核对
把“引用标准清单”变成正式交付物。在标书、方案、计算书或合规报告发布前,由负责人确认版本、状态、适用地区和替代关系。

结语:能找到,只是起点
对企业负责人来说,规范库里有多少文件,不是第一个问题。
第一个问题应该是:任何一条准备进入当前项目的依据,系统能否证明它来自哪个版本、现在是否有效、谁核对过、允许用在哪里。
这才是 AI 规范库的价值。它不只是让模型记住更多条文,而是让使用者看到一个结论的完整上下文:来自哪本规范,是哪个版本,现在是什么状态,谁核对过,能用在哪里,还有什么没审完。
一条旧规范可以被完整抽取、准确切片、稳定召回,甚至每次都能回到原 PDF。
只要它已经废止,这条技术链路就不能自动变成当前工程依据。
规范库要管的,不只是文本。它还要管状态、证据、用途和责任。
参考资料
- 住房城乡建设部,关于发布行业标准《建筑与市政工程施工现场临时用电安全技术标准》的公告,住房和城乡建设部公告 2024 年第 152 号。
- ArchSight Standards,JGJ 46-2005 与 JGJ/T 46-2024 现行性、替代关系和导入边界核对记录,核对日期为 2026 年 7 月 17 日。
如果你的团队正在建设 AI 规范库
如果你正在评估企业规范库、RAG 检索或合规辅助系统,欢迎通过文末入口或平台私信,简单说明当前使用场景、已导入的资料类型,以及是否已经建立版本核对和人工复核流程。我们会先判断是否适合开展一次小范围的版本安全检查或验证。
关注我们
欢迎搜索并关注 筑见实验室,获取更多建筑 AI、结构计算与工程数字化实践:
