# 上下文领域 SoT > 数据权威层级、落库纪律和 raw 边界以[领域索引](./_index.md)为准(横切合同见索引 §3,raw 见索引 §8,可恢复性见 [08-数据权威与可视化领域](08-数据权威与可视化领域.md))。本文只定义上下文领域如何从库里选择、冻结、裁剪并投影角色可见输入。 ## 1. 唯一职责 上下文领域负责根据一次任务的作品、目标章、用途、角色和预算,从数据库中选择来源,冻结版本,裁剪字段,并投影成角色可见输入。它回答“这个 Agent 在这次任务中应该看到什么、为什么能看、哪些内容被省略”。 上下文领域不创作正文、不修改实体、不评价候选质量,也不授权自己扩大来源范围。它只读库,不写库;写入由现有管线和 Skill 负责(见索引 §3)。 ## 2. 输入与输出 输入至少包含: - `work_id` - `target_chapter` - `as_of` - `purpose` - `scenario` - `agent_role` - `source_policy_version` - `context_budget` 输出分两层: 1. 完整冻结清单:来源标识(库内 `sourceId` / `sourceVersion`,不是文件路径)、内容哈希、版本、章号范围、选择理由、省略理由和总预算。 2. 角色投影:只包含该角色完成本次任务需要的字段,不暴露运行身份、授权密钥、实验臂、raw 路径或无关来源。 ## 3. 来源优先级(作为门禁) ```text 已确认规划和作品边界 > 正式内容(Canonical)正文与正式实体/状态 > 作品明确绑定的激活范式 > 品类或全局激活范式 > 待审/评测中内容(仅诊断用途) ``` - 生产用途必须命中“激活的正式实体 + 已绑定”,否则失败关闭;不靠降级、重试或人工说明绕过。 - 作品事实不能由范式替代;范式只提供写法,不提供人物或事件事实。 - 回放任务严格拒绝目标章和未来章;正向创作读取最新正式内容和已确认规划。 - 来源缺失、哈希不符或章号上界无法证明时,失败关闭或显式省略,且省略带机械可读原因。 - 待建(目标合同):来源优先级从“门禁”升级为“择高降级裁决”——在更高优先来源可用时优先取用、低优先来源只在显式授权下降级使用,并给出裁决记录。 ## 4. 数据库读取器(核心实现) 数据库读取器是本领域的核心实现,对齐 [`read-context`](../../../../.claude/skills/read-context/SKILL.md) 现状:从库读可信来源、冻结、再投影。它必须能够: 1. 从库中枚举作品、实体和范式,按 ID、类型、名称、别名、scope、scenario 和章号过滤。 2. 解析库内 schema 并确认来源可溯(来源能回到已导入参考书或作品自身正式内容);不做多租户授权快照重验(96 不启用,领域索引 §9),确认每条来源可被本次任务合法读取。 3. 对选中内容计算稳定哈希:先剔除运行期易变字段,再对规范化后的 JSON 求哈希(`retrieval_identity`),保证同一内容不因无关字段变动而改变身份。 4. 在固定排序和预算下产生可重复的冻结清单(manifest);排序规则固定为按相似度分降序、版本升序、来源升序、偏移升序,同样输入必得同样来源集合与哈希。 5. 按指针回读库行(在只读、可重复读事务中按 `sourceId` / `sourceVersion` 取正式内容行),构造角色投影。 连续前四章全文构成近期基线,不可裁剪;若预算不足以容纳基线加硬约束,失败关闭,不静默丢硬约束、不截断连续正文。作品事实(实体卡、设定、叙事状态)按字段授权逐字段裁剪(aiContext 字段级裁剪),不整表倾倒,也不把未来状态降格为当前事实。 ## 5. 加速边界 - 库内检索加速(向量索引,pgvector)只负责候选召回,返回候选 ID / 来源路径,不负责事实裁决。 - 可信组装器拿到候选后仍回读库行并验证哈希;加速结果与权威行不一致时丢弃加速结果并重建投影。 - 向量索引是数据库一侧的派生加速,可从库重建;它失效只影响速度,不改变内容语义、不跳过审核(见索引 §2、§7)。 - **数据库是权威**:库不可用 = 该次任务失败关闭,不假装有本地兜底。不存在“外部不可用自动降级到本地”的路径。 ## 6. ReAct Agent 边界 ReAct Agent 可以调用上下文 Skill 请求补充证据,但不能自行访问数据库、遍历全库、修改检索计划、读取未来内容,或把待审候选/候选范式提升为事实。补证必须产生新的冻结清单和新的输入哈希,再启动新的模型调用。 ## 7. 审计与 raw - 安全 manifest(来源标识、版本、章号、字符数、裁剪与省略原因、状态、哈希)落库可查;安全回显只含这些元信息,不含原文与完整问答。 - 完整角色输入、Prompt、Response、未接受候选正文、评测专用答案属于 raw,**落库**(单独表 + 访问控制),只读看板可看全文(见索引 §8);不再要求进仓外 vault,仓外 vault 仅为可选备份。 - 密钥、token、运行身份、授权凭据不写进内容表或运行报告。 ## 8. 验收条件 1. 同一作品、选择计划、冻结点和预算,产生相同的来源集合与内容哈希。 2. 数据库是权威:读取器对库只读、失败关闭;任何来源、字段授权、冻结点、哈希或预算无法验证时失败关闭。可恢复性见 [08-数据权威与可视化领域](08-数据权威与可视化领域.md)。 3. 未来信息、未确认实体和未激活范式不会进入正式创作输入;回放任务拒绝目标章与未来章。 4. writer、detector、judge 等角色只看到各自投影,互不暴露运行身份、密钥、实验臂、raw 路径。 5. 每个选中和省略来源都有机械可读原因。 6. 连续前四章全文基线不可裁剪;预算不足以容纳基线加硬约束时失败关闭而非截断。 ## 9. 关联 SoT - 内容来源:[01-作品领域](01-作品领域.md)、[02-实体领域](02-实体领域.md)、[03-范式领域](03-范式领域.md) - 数据权威与 raw:[08-数据权威与可视化领域](08-数据权威与可视化领域.md) - 当前 Skill:[`read-context`](../../../../.claude/skills/read-context/SKILL.md) - 上级上下文合同:[专题-03](../../../../../design-docs/专题-03-AI编排上下文与质量评测实现规范.md)