zizi 63a65ae9ff 框架(设计): 立落库与看板设计稿,看板菜单树重订为领域布局,清理不启用96残留
- 新增 docs/2026-07-30 落库与看板设计稿:97-102 表设计(含 102 智能体/技能登记表 A 方案)、写路径、raw 合同、实施顺序
- 可视化合同 §10 重写为领域布局菜单树(五空间+作品工作区+章工作区+跨空间互联+数据来源标注+分阶段点亮)
- 清理'不启用 96'残留:合同§9、02/04/08 领域、落库稿统一改为不启用/以 reference_work 为准
- 03 范式补 draft_type 现状标注;_index §4 零依赖口径对齐合同;08 §9/§10 状态收敛
2026-07-31 00:31:16 +08:00

89 lines
6.4 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# 上下文领域 SoT
> 数据权威层级、落库纪律和 raw 边界以[领域索引](./_index.md)为准(横切合同见索引 §3,raw 见索引 §8,可恢复性见 [08-数据权威与可视化领域](08-数据权威与可视化领域.md))。本文只定义上下文领域如何从库里选择、冻结、裁剪并投影角色可见输入。
## 1. 唯一职责
上下文领域负责根据一次任务的作品、目标章、用途、角色和预算,从数据库中选择来源,冻结版本,裁剪字段,并投影成角色可见输入。它回答“这个 Agent 在这次任务中应该看到什么、为什么能看、哪些内容被省略”。
上下文领域不创作正文、不修改实体、不评价候选质量,也不授权自己扩大来源范围。它只读库,不写库;写入由现有管线和 Skill 负责(见索引 §3)。
## 2. 输入与输出
输入至少包含:
- `work_id`
- `target_chapter`
- `as_of`
- `purpose`
- `scenario`
- `agent_role`
- `source_policy_version`
- `context_budget`
输出分两层:
1. 完整冻结清单:来源标识(库内 `sourceId` / `sourceVersion`,不是文件路径)、内容哈希、版本、章号范围、选择理由、省略理由和总预算。
2. 角色投影:只包含该角色完成本次任务需要的字段,不暴露运行身份、授权密钥、实验臂、raw 路径或无关来源。
## 3. 来源优先级(作为门禁)
```text
已确认规划和作品边界
> 正式内容(Canonical)正文与正式实体/状态
> 作品明确绑定的激活范式
> 品类或全局激活范式
> 待审/评测中内容(仅诊断用途)
```
- 生产用途必须命中“激活的正式实体 + 已绑定”,否则失败关闭;不靠降级、重试或人工说明绕过。
- 作品事实不能由范式替代;范式只提供写法,不提供人物或事件事实。
- 回放任务严格拒绝目标章和未来章;正向创作读取最新正式内容和已确认规划。
- 来源缺失、哈希不符或章号上界无法证明时,失败关闭或显式省略,且省略带机械可读原因。
- 待建(目标合同):来源优先级从“门禁”升级为“择高降级裁决”——在更高优先来源可用时优先取用、低优先来源只在显式授权下降级使用,并给出裁决记录。
## 4. 数据库读取器(核心实现)
数据库读取器是本领域的核心实现,对齐 [`read-context`](../../../../.claude/skills/read-context/SKILL.md) 现状:从库读可信来源、冻结、再投影。它必须能够:
1. 从库中枚举作品、实体和范式,按 ID、类型、名称、别名、scope、scenario 和章号过滤。
2. 解析库内 schema 并确认来源可溯(来源能回到已导入参考书或作品自身正式内容);不做多租户授权快照重验(96 不启用,领域索引 §9),确认每条来源可被本次任务合法读取。
3. 对选中内容计算稳定哈希:先剔除运行期易变字段,再对规范化后的 JSON 求哈希(`retrieval_identity`),保证同一内容不因无关字段变动而改变身份。
4. 在固定排序和预算下产生可重复的冻结清单(manifest);排序规则固定为按相似度分降序、版本升序、来源升序、偏移升序,同样输入必得同样来源集合与哈希。
5. 按指针回读库行(在只读、可重复读事务中按 `sourceId` / `sourceVersion` 取正式内容行),构造角色投影。
连续前四章全文构成近期基线,不可裁剪;若预算不足以容纳基线加硬约束,失败关闭,不静默丢硬约束、不截断连续正文。作品事实(实体卡、设定、叙事状态)按字段授权逐字段裁剪(aiContext 字段级裁剪),不整表倾倒,也不把未来状态降格为当前事实。
## 5. 加速边界
- 库内检索加速(向量索引,pgvector)只负责候选召回,返回候选 ID / 来源路径,不负责事实裁决。
- 可信组装器拿到候选后仍回读库行并验证哈希;加速结果与权威行不一致时丢弃加速结果并重建投影。
- 向量索引是数据库一侧的派生加速,可从库重建;它失效只影响速度,不改变内容语义、不跳过审核(见索引 §2、§7)。
- **数据库是权威**:库不可用 = 该次任务失败关闭,不假装有本地兜底。不存在“外部不可用自动降级到本地”的路径。
## 6. ReAct Agent 边界
ReAct Agent 可以调用上下文 Skill 请求补充证据,但不能自行访问数据库、遍历全库、修改检索计划、读取未来内容,或把待审候选/候选范式提升为事实。补证必须产生新的冻结清单和新的输入哈希,再启动新的模型调用。
## 7. 审计与 raw
- 安全 manifest(来源标识、版本、章号、字符数、裁剪与省略原因、状态、哈希)落库可查;安全回显只含这些元信息,不含原文与完整问答。
- 完整角色输入、Prompt、Response、未接受候选正文、评测专用答案属于 raw,**落库**(单独表 + 访问控制),只读看板可看全文(见索引 §8);不再要求进仓外 vault,仓外 vault 仅为可选备份。
- 密钥、token、运行身份、授权凭据不写进内容表或运行报告。
## 8. 验收条件
1. 同一作品、选择计划、冻结点和预算,产生相同的来源集合与内容哈希。
2. 数据库是权威:读取器对库只读、失败关闭;任何来源、字段授权、冻结点、哈希或预算无法验证时失败关闭。可恢复性见 [08-数据权威与可视化领域](08-数据权威与可视化领域.md)。
3. 未来信息、未确认实体和未激活范式不会进入正式创作输入;回放任务拒绝目标章与未来章。
4. writer、detector、judge 等角色只看到各自投影,互不暴露运行身份、密钥、实验臂、raw 路径。
5. 每个选中和省略来源都有机械可读原因。
6. 连续前四章全文基线不可裁剪;预算不足以容纳基线加硬约束时失败关闭而非截断。
## 9. 关联 SoT
- 内容来源:[01-作品领域](01-作品领域.md)、[02-实体领域](02-实体领域.md)、[03-范式领域](03-范式领域.md)
- 数据权威与 raw:[08-数据权威与可视化领域](08-数据权威与可视化领域.md)
- 当前 Skill:[`read-context`](../../../../.claude/skills/read-context/SKILL.md)
- 上级上下文合同:[专题-03](../../../../../design-docs/专题-03-AI编排上下文与质量评测实现规范.md)