23 KiB
专题-07:知识消费契约与质量闭环
- 版本:v2
- 更新日期:2026-07-20
- 目标读者:产品 / 架构 / 后端 / 测试
- 边界说明:本册是「知识效用」这条横切主线的单一 owner——回答「该读什么知识、注入后有没有用、知识本身好不好」,收束四件此前无主的事:知识消费选择契约(含按用途默认合同与注入视图)、知识质量三性、回放评测、长线进度消费语义;文末附实验台实证附录。以下邻册对象本册只链接、不重复定义:Context Assembly 分层与 Token 预算见 专题-03 §4、检索结果合同见 专题-03 §5.3、统一创作数据读取器读合同见 专题-06 §7、输出侧质量维度见 专题-04、结构本体与字段合同见 专题-06 §4 与 后端-04、Narrative State 与双轨见 架构-02。核心主张一句话:知识的价值只在被选中并改善产出——写作、检测、规划三个效用时刻——的那一刻兑现;质量标准必须由消费端定义、由回放评测测量——以用定卡。
- 变更记录:v2(2026-07-20)在 §2.1 固化正文消费的「卡是索引、按来源回读冻结原文」契约,并区分抽取卡证据与正式设定、Canonical 状态、细纲新事实三类独立权威来源。v1(2026-07-17)建立知识消费选择、质量三性、回放评测和长线进度消费语义。
0. 术语桥
理解本册的钥匙:SoT 里没有「卡」这个一级概念。产品与实验台口语里的「知识卡片 / 卡」是一组权威载体的统称,本册全部论述落到这组载体上,不新造模型。
| 口语说法 | SoT 权威载体 | owner |
|---|---|---|
| 待确认的卡 | Knowledge Draft(待审、默认不可信) | 架构-02 §4.2 |
| 本作正式事实卡 | Local Knowledge Entity · Relation(本作正式实体/关系) | 架构-02 §4.2 |
| 公共参考卡 | Global KB 范式 Canonical(跨作品公共参考) | 架构-02 §1.2 / §4.1 |
| 卡的结构模具 | MetaSchema target_type(23 型) | 专题-06 §4.3 |
两个实验台口语也一次性登记,下文实证引用沿用:范式卡 = 技法五型的公共参考卡(进 Global KB);升格卡 = 世界域型的实体演变卡——产品内是本作事实卡(进 Local KB),实验台以参考书彩排时其产物落参照作品面(见 §5)。
登记:拆书实验台(agent-example,仓内实验目录)是本册与专题-06 的排练场——设计不等于进度,实验台证据只作本册论断的实证输入,不代表产品已实现。
1. 第一性原理:知识是外置记忆,缺的是效用闭环
一句话钥匙:长篇创作的一切质量问题,本质都是记忆问题;知识库就是这套系统的外置记忆。
模型上下文有限且没有持久状态,百万字长篇里吃设定、前后矛盾、角色失声、升级线错乱,根子都是「该记住的没被带回来」。抽卡的唯一目的,是让知识在未来某次生成里被选中、被注入、改善产出。记忆兑现价值的时刻只有三个,与智能体分工一一对应(专题-06 §3)。
| 效用时刻 | 谁在用 | 用什么 |
|---|---|---|
| 写作时注入 | 写作智能体 | 实体当前态 + 技法范式参考 |
| 检测时对照 | 检测智能体 | Local KB 当标准,查候选是否吃设定(对应 canon_compliance) |
| 规划时排线 | 规划智能体 | 演变历程 + 参照书成长曲线,排下一个台阶 |
产品承诺就锚在这三个时刻上。产品-01 的核心卖点原话是「已确认知识在下一次生成时真正回到上下文」,叙事质量承诺是「角色弧光、情节推进、悬念维护和章节张力」不退化——兑现这两句承诺的机器正是本册。
缺环在哪:治理侧全线完备,效用侧全线空缺。
| 侧面 | 问的问题 | 现状 |
|---|---|---|
| 治理(能不能读) | 授权 / 来源 / 双轨 / 裁剪 / 预算 | 钉死(专题-03、专题-06 §7、架构-02) |
| 效用(该不该读、好不好) | 这一幕该选哪些知识、什么算一条好知识、注入后有没有用 | 无 owner、无定义、无测量 |
最锋利的一条必须写死——记忆腐坏时,输出端门控不但补偿不了,还会放大伤害。检测维度 canon_compliance 拿 Local KB 当对照标准来拦候选(专题-04 §4.2):知识错了,门控会把写对的候选当成「吃设定」拦下来。所以输入端质量不是锦上添花,是输出端门控成立的前提。
2. 知识消费选择契约
一句话钥匙:读取器(专题-06 §7)解决「能不能读 + 怎么裁字段」,本节补「该读哪几条」——按知识形态分两类合同,选择键不同、注入形态不同。
| 知识形态 | 选择键(该读哪几条) | 注入什么 | 不做什么 |
|---|---|---|---|
| 本作事实(Local KB 实体/关系/事件) | 在场召回(当前场景出场实体 + 其关系闭包)+ 相似召回兜底 | 实体当前态摘要 | 不注入全演变历程——历程按 aiContext 用途裁剪,续写不给(实验台实证:演变历程标 [detection, extraction],防上万字明细撑爆上下文) |
公共范式(Global KB 技法五型 craft/combat/emotion/scene_pattern/trope) |
结构化匹配:型 × 场景意图(打斗/情感/通用桥段)× 线程弧位(trope 管「这条线接下来几章怎么走」)× 品类 |
规划期选定的范式引用 | 不靠相似度临场海选——范式描述与正文语域不同,实验台实证同型范式向量相似 74% 多为词汇假近,语义真并率仅约 10% |
口径说明:上表「公共范式」行指写作期的技法范式;style/pacing 的跨作品公共面(含参照作品面蒸馏出的成长曲线范式,见 §5)按 planning 行的结构键召回,不走写作期注入。
范式进入生成上下文的正路是「规划期决策、写作期引用」,不是写作时临场向量海选。规划产出必须显式挂所引范式的引用,形成「规划决策 → 写作引用」链;写作期只按引用注入,不重新检索范式。
按用途的默认合同——统一读取器 purpose 四值(专题-06 §7)逐一钉死默认选择;分层次序与 Token 预算的上位规则见 专题-03 §4.2,本表只定「该选哪几条」:
| purpose | 默认注入 | 明确不注入 |
|---|---|---|
| generation(续写/场景写作) | 在场实体(当前章出场 + 一跳关系)的当前态摘要视图;规划期已决策引用的公共范式(上限 3 条,全文视图);文风/节奏画像 | 范式临场海选;演变历程全线 |
| planning(规划/排线) | 目标线程实体的演变历程全线;大纲与作品核心;Global 成长曲线范式(型 × 品类结构键召回,相似度只作兜底) | — |
| detection(一致性检测) | 在场实体当前态全量 + 关系闭包 + 事件时间线 | 公共范式(检测不需要「怎么写」) |
| extraction(抽取/维护知识) | 该型模具全字段视图 | — |
flowchart LR
subgraph P["消费用途 purpose"]
direction TB
G["写作 generation"]
D["检测 detection"]
PL["规划 planning"]
X["抽取 extraction"]
end
subgraph F["知识形态 → 选择键"]
direction TB
L["本作事实(Local KB)<br/>在场召回 + 相似兜底"]
C["公共范式(Global KB 技法五型)<br/>型 × 场景意图 × 线程弧位 × 品类"]
end
subgraph V["注入视图(≠ 存储形态)"]
direction TB
VS["摘要 / 全文两档"]
VR["排序:结构匹配度 + 效用统计"]
end
P -->|按 aiContext 用途裁深浅| F
L --> V
C -->|规划期决策·写作期引用| V
联合与冲突:来源优先级全链对齐 产品-01——本作事实(Local KB)> 用户绑定知识(User KB 与已安装知识库)> 全局与市场参考(Global KB 范式、市场资产摘要),冲突时低优先级来源不得替代高优先级事实;范式只提供「怎么写」,不得覆盖「是什么」。
卡粒度预算:进入上下文的是注入视图,不是整条存储记录。注入视图分两档——摘要视图(名称 + 一句话摘要 + 当前态要点)是默认档,焦点实体升全文视图(按 aiContext 裁剪后的字段全量)。排序信号 = 结构匹配度(在场 > 关系一跳 > 相似兜底;范式取型 × 场景意图 × 品类的精确匹配优先)+ 效用统计(被命中率 / 被接受率 / 跨书频次);预算内截断落 omittedSources(截断规则归 专题-03 §4.2)。实验台实证两端病并存——p50 卡体仅 395 字符(薄到无肉可注)与单卡 104KB(角色卡流水累积,一张即撑爆预算)——这证明注入视图必须是一份独立合同,不能等于存储形态。
2.1 正文消费的卡索引与原文回读契约
正文生成再加一条不可绕过的消费规则:卡是索引,根据抽取卡记录的来源回读原文;卡不能替代原文。 卡负责缩小检索范围、指出相关实体与历史状态,冻结线内的历史原文负责证明人物声音、动作习惯、能力表现和叙事质感。读取器不得把卡片正文直接倾倒给写手,或把抽取摘要伪装成历史原文证据。
| 来源类型 | 进入正文上下文的条件 | 证据落点 |
|---|---|---|
| 由历史正文抽取的卡 | 必须携带 sourceVersion、sourceRefs 和按冻结点重建的 stateAsOf;系统沿 sourceRefs 回读 chapter <= asOf 的原文,并记录章节、Block、字符区间与内容哈希 |
卡只保留索引视图;事实约束与写法参考分别进入 专题-03 §4.5 的双证据字段 |
| 无可追踪原文来源的抽取卡 | 只能作为 unverifiedIndexHint 暴露缺口,不得单独支撑正文硬事实 |
进入省略/缺口清单,不进入可采信事实证据 |
| 作者确认的正式设定 | 直接引用其不可变正式版本,不要求伪造历史原文来源 | 独立权威事实证据 |
| Canonical 状态 | 直接引用当前冻结点可见的正式状态版本,不要求抽取卡二次背书 | 独立权威事实证据 |
| 细纲声明的本章新事实 | 以已确认细纲版本为权威,标记 declared_new;它不是历史事实,不得强造原文来源 |
独立权威事实证据与新设定申报 |
卡片与其来源是否落在冻结线内,只按 专题-03 §4.5 的 RetrievalManifest 和冻结规则判断;本册只拥有“选卡后必须回读什么”以及哪些正式事实不依赖抽取卡的消费规则。
3. 知识质量三性(输入侧质量维度)
一句话钥匙:三性是输入侧检尺,与专题-04 的输出侧维度同构——模具与检尺分立、单向咬合(专题-04 §4);输出维度检「写出来的字好不好」,三性检「拿去写的知识好不好」。
| 质量性 | 定义 | 失败实证(实验台) | 可测指标建议 |
|---|---|---|---|
| 可命中 | 该被想起时能被检索到:命名鲁棒(别名表)+ 向量覆盖 + 结构键齐全 | 升格卡命名脆,同一实体断成两条成长线(「生物机甲」与「铁头」分家);升格卡向量覆盖为 0,尚未接入检索 | 别名覆盖率(有别名表的实体卡占比)、向量覆盖率(有活向量的活卡占比)、同实体分裂率(抽样审计中同一真实实体被建成多条卡的比例) |
| 可行动 | 注入后能直接改善产出,而非一段分析散文 | 升格台阶粒度过长、单位事件串进体系卡;实体卡缺「当前态摘要」 | 注入视图尺寸达标率(落在该型登记上限内的占比)、字段充实度(对照该型字段合同的非空率) |
| 可持续 | 增量维护下不腐坏:判重「同名异质不并、真同才并」、演变归并有序、溯源完备 | 向量相似 74% 多为同型词汇假近、真并率仅约 10%——「同名异质不并」是对的(宁缺勿滥) | 重复率(消费端召回中判为同一知识的比例)、演变断线率(抽样审计中同实体演变断成多线的比例)、溯源完整率(可回溯到来源与归并审计的卡占比) |
范式卡字段形态已较好(公式 / 启动条件 / 失效风险 / 张力来源),实体卡的短板是缺当前态摘要;可持续还要求演变按真实章号排序、溯源可回溯可撤销。
单实例长尾必须点明:实验台实证范式卡 p50 实例数 = 1——「只被观察到一次的范式」只是观察不是范式。跨书频次是范式可信度的核心信号,消费端效用统计(命中 / 接受)是最终裁决。质量三性的裁决权在消费端,不在抽取端。
三性指标的阈值不拍脑袋:由回放评测(§4)首轮基线确定,此后进入质量策略生命周期管理(draft → evaluating → active,见 专题-04 §9.2),与输出侧维度同一套治理节奏。
4. 回放评测:质量的测量闭环
一句话钥匙:参考书本身就是标准答案。 冻结第 N 章时点的知识状态 → 按 §2 契约组装上下文 → 跑规划/续写/检测 → 与原书第 N+1 章(或后续台阶)对照评分,把知识质量从口味变成数字。
| 评测线 | 怎么跑 | 评什么 |
|---|---|---|
| 规划线 | 用第 N 章知识预测下一台阶 / 伏笔回收,对照原书实际走向 | 台阶预测命中、伏笔回收命中 |
| 生成线 | 有卡 vs 无卡 vs 打乱卡 的对照生成 | 设定一致性、要素覆盖 |
| 检测线 | 人工向候选注入错误 | 错误检出率 |
评的是整体:知识质量 × 选择策略 × 提示词共同决定回放得分,必须变量控制对照才能归因。落位上,回放评测是 专题-04 §10 离线评估框架内的一类评估——该框架的评估输入已含 Context Assembly Strategy,本册补「知识策略」这一评估对象维度。样本合规两道闸:授权状态闸对齐 专题-06 §6.2 的 reference_work 授权四值,unauthorized 失败关闭、不进评测;评测用途闸——版权状态不等于评测许可,样本进入评测必须绑定不可变授权快照且 allowedPurpose 包含离线评测(对齐 专题-03 §4.3 「授权按用途执行」与 专题-04 §10 的允许样本四类),research_only 只限内部评测、禁外发。评测产物只存评分、摘要与章节定位,不留存原书全文。
由此立一条门禁:知识策略(选择契约参数、注入视图定义、判重规则)的变更,未经回放对照评测不得上线、不得声称改善质量——对齐 专题-04 §9.2 策略生命周期的 evaluating → active,评测未过就没有 active。
知识策略(Knowledge Strategy)是一个正式策略对象,与 Quality Policy 同栖 AI 编排的策略面、同一套治理节奏:内容 = 选择契约参数(§2 默认合同的可调参数)+ 注入视图定义(各型两档视图与尺寸上限)+ 判重规则(§3 可持续判据);生命周期 = draft → evaluating → active(专题-04 §9.2);每次评测与生成任务记录其版本引用(评测输入登记见 专题-04 §10),回滚只影响后续任务、不改写历史结果。
拆书实验台是回放评测的第一个排练场:书(8 本约 1.18 万章)+ 卡(范式 6327 / 升格 2260)+ 章级锚点(实例 / 里程碑带真实章号)三要素已齐,是唯一能把卡质量落成数字的地方。
flowchart LR
Prod["生产<br/>拆书抽取 · 23 型模具"] --> Gov["治理<br/>双轨确认 · 授权/来源"]
Gov --> Sel["选择<br/>§2 消费契约<br/>冻结第 N 章知识状态"]
Sel --> Inj["注入<br/>§2 注入视图组装上下文"]
Inj --> Gen["生成 / 检测 / 规划"]
Gen --> Cmp["对照原书<br/>第 N+1 章 / 后续台阶"]
Cmp --> Score["评分<br/>规划线 / 生成线 / 检测线"]
Score -. 反哺卡质量三性 .-> Prod
Score -. 反哺选择策略 .-> Sel
5. 长线进度消费语义(演变历程如何被用)
一句话钥匙:长篇(尤其升级流品类)的骨架是实体演变——力量体系、装备、角色的台阶推进;载体已在,缺的是消费语义。
载体 = Narrative State(架构-02 §3,作品/章节/实体三维叙事运行态)+ 演变历程字段。实验台已在六个世界域型上实证 {章, 台阶, 周期} 的结构化里程碑。演变历程分三期消费。
| 消费期 | 用谁 | 怎么用 |
|---|---|---|
| 规划期 | 本作历程 + 参照曲线(拆书沉淀的跨书台阶间距/周期分布) | 排下一台阶的时机与幅度 |
| 检测期 | 当前态对照 | 新候选不得与当前台阶矛盾 |
| 写作期 | 只给当前态摘要 | 全历程默认不进(aiContext 用途不含 generation) |
参照作品面:参考书的实体演变卡落参照作品面——系统侧证据资产,不进 Global KB、不可被作品绑定,定义、承载与版权治理见 专题-06 §6.4。本册只消费它的两个用途:①回放评测的标准答案底座(§4);②蒸馏源——进入 Global KB 的只能是蒸馏后的叙事域「成长曲线范式」(trope/pacing 形态),供规划期作参照曲线。
6. 实验台实证附录
一句话钥匙:实验台是排练场;下表只陈述已被 9 批实拆检验的事实,及各事实结论的唯一 owner 分册。
| 实验台已实证 | 结论归属分册 |
|---|---|
| 23 型结构本体实战可用 | 专题-06 |
aiContext 按 4 用途(planning/generation/detection/extraction)字段级裁剪可落地 |
架构-02 §9(值域已升级为布尔或用途集)/ 专题-06 §7 |
| 演变历程结构化里程碑 {章,台阶,周期} | 专题-06 §4.5 / 后端-04 字段合同 |
| 判重判据「同名异质不并」 | 本册 §3 |
| 单实例长尾与跨书频次信号 | 本册 §2 / §3 |
| 升格卡注入视图两端病(395 字符 / 104KB) | 本册 §2 |
| 参考书实体演变卡可产、可逆、带真实章号锚点(参照作品面的可行性底座) | 专题-06 §6 / 本册 §5 |
7. 验收清单
本册闭合后必须满足以下可判定条款:
- 任何新增知识型进入 Global KB 检索集前,必须同时给出 §2 的选择键(怎么被选中)与注入视图定义(注入什么形态),二者随该型字段合同登记,缺一不得入检索集。
- 进入生成上下文的必须是注入视图,不得是整条存储记录;各型注入视图的尺寸上限随字段合同登记,超限判不合格、不注入。
- 公共范式进入生成上下文的路径只有「规划期决策、写作期引用」——规划产出必须携带所引范式的引用链,写作任务记录必须能回指该引用;写作期对范式做临场相似度海选的链路判违规。
- 回放评测在某作品/品类跑通前,涉及该范围的知识策略变更不得对外声称「提升质量」;质量声明必须附回放运行标识(评估集版本 + 知识策略版本 + 三线得分)与变量控制说明。
- 判重遵循「同名异质不并、真同才并」;每次归并必须留存可判定的并类判据与被并卡快照(归并审计),缺审计的归并判违规(宁缺勿滥)。
- 演变历程默认不进写作期上下文(
aiContext用途不含 generation),违反即记为撑爆预算风险项。 - 参考书样本进入回放评测前必须同时通过授权状态闸(
reference_work四值,unauthorized失败关闭)与评测用途闸(授权快照allowedPurpose含离线评测);评测产物不得留存原书全文。 - 卡的每个结构部件(检索键 / 注入体 / 演变链 / 溯源)的消费者以字段级
aiContext用途标注为准;无任何用途标注且不承担溯源/审计治理职能的部件按赘肉裁撤,不随卡进上下文。
8. 关联阅读
| 主题 | 权威文档 |
|---|---|
| Context Assembly 四层与 Token 预算、检索结果合同、质量评测输入合同 | 专题-03-AI编排上下文与质量评测实现规范 |
| 输出侧质量维度、离线评估框架 | 专题-04-生成质量门控与创作健康度设计方案 |
统一读取器读合同、结构本体 23 型与三层浇铸、拆书两处浇铸、reference_work 授权四值 |
专题-06-元数据驱动的智能体架构 |
双轨模型、Narrative State、三类知识库、MetaSchema aiContext 控制项 |
架构-02-核心数据结构与双轨模型 |
| 知识来源优先级(本作事实高于公共参考)、核心价值承诺 | 产品-01-产品定位与核心价值 |
| 逐型字段合同 | 后端-04-统一数据库Schema-v1 |