系统与流程

检索链路、知识库与选型

规范按"章—节—条"结构化,保留完整条文与元数据;检索走"关键词 / 全文 + 向量召回 + Rerank",并按质量与成本完成模型选型。

RAG 检索链路

从规范正文到可溯源答案
阶段输入处理规则输出控制措施评测指标
规范结构化规范正文按章-节-条识别层级,保留完整条文结构化条文 + 元数据按条款编号切分并保留层级条款完整率
向量化结构化条文Embedding 写入向量库向量索引保留关键词索引并混合召回Recall@K
问题解析用户问题 + 历史上下文识别意图、实体、条件和歧义结构化查询意图缺关键条件时先澄清意图准确率
查询扩展结构化查询意图术语 / 同义词扩展、数字标准化多组检索词限定领域词典与原始实体Recall@K
多路召回检索词关键词 / 全文 + 向量检索候选条文集合两路合并去重Recall@K / Precision@K
重排与生成候选条文Rerank 排序后按证据生成答案结构化答案 + 条款引用无相关证据返回空集合引用正确率

知识库构建

标准正文按章、节、条划分层次;先做结构化拆解,才能谈条文规则解译。

章—节—条结构化拆解
层级编号示例说明
3 厂房和仓库行首数字 + 空格 + 标题
3.1 火灾危险性分类行首 数字.数字 + 标题
3.1.1 / 5.1.3A数字.数字.数字 + 空格 + 内容

模型横评与选型

横评采用 500 条测试集中的 60 条分层抽样样本,离线回放评测。

模型横评(60 条分层抽样)
模型准确性完整性忠实性引用正确率平均响应成本选型
DeepSeek-R14.774.704.8296.7%4.2s主模型
Qwen4.584.504.6295.0%2.8s备选
GPT-4o4.854.784.8798.3%3.2s质量基准

Prompt 与规则

各模块的核心规则与禁止项
模块输入输出核心规则禁止项
意图识别用户消息 + 历史上下文明确任务类型一次完成路由判断不直接生成无依据规范结论
歧义澄清用户问题 + 实体 + 领域词典澄清问题 + 候选项只追问影响检索的关键条件重复追问同一维度
Rerank用户问题 + 候选条款排序后的条款 ID直接相关优先保留明显无关条款
答案生成问题 + 检索证据clause / content / answer / confidence仅根据证据;必须引用;保留程度词补充证据外的数字或结论
多轮问答历史 + 本轮问题 + 本轮证据结构化回答历史用于理解指代,本轮证据决定结论沿用旧结论替代本轮检索