正文智能体正式优化架构

卡负责定位,原文负责表现,正式设定负责事实,writer 只负责创作。生产链与离线评测链严格分离。

两个方向不能混用

能力验证

正文智能体 → 细纲智能体 → 大纲+设定智能体。自底向上隔离变量。

正式生产

大纲+设定 → 细纲 → 正文智能体。自顶向下提供创作输入。

生产链

1. 已确认细纲硬事件、可调节拍、伏笔、钩子和新设定声明。
2. 检索规划与卡索引按 asOf 重建当前态,带出历史来源指针。
3. 连续四章 + 原文回读事实证据与表现证据分开装配,生成确定性 manifest。
4. 无工具 Writer只接收 WriterContext;可按预算请求补证。
5. Detector 硬门核细纲、事实、证据、时间线和输出合同,最多返修两轮。
6. Shadow 与用户三决策原样接受先做 accept_preflight;修改后合并生成新版本 → detector → 返回 Shadow → accept_preflight;通过后 confirm。
补证环

Writer 可返回结构化 evidenceRequests;最多 3 次,累计新增上下文不超过检索预算 30%。

返修环

Detector 只阻断可验证硬错误;Writer 最多自动返修 2 轮,仍失败则交用户。

创作自由边界

硬事件、结果和伏笔不可改;场景可拆并调序,可创造环境、动作、过渡和对白;新增 Canonical 事实必须申报。

双证据模型

Fact Evidence

正式设定、Canonical 卡、状态台账、已确认正文和细纲声明的新事实,负责“写得对”。没有可靠事实来源的硬结论必须阻断。

Prose Evidence

历史原文场景,负责人物声音、动作习惯、能力表现、段落节奏和章末钩子,回答“怎么写得像”。

离线评测链

A/B/C 三臂原文线、卡线、双线;A/B 只作诊断,不能被接受。
统一 Detector授权、冻结、泄漏和候选结构门保持一致。
双独立盲评臂名掩码,第二评委反序,评分步长 0.5。
稳定性 / 第三评委同维差值超过 0.5 时最多增加一次第三评委。
Gate A / Gate BGate A:不足5章=insufficient;任一 schema/泄漏/系统/硬门失败=failed;其余 passed。Gate B:不足2书10章或不稳定>20%=insufficient;硬错或文风/张力退化=failed;保真均值≥+0.25且60%样本正增益=passed;其余 no_gain。仅 passed 解锁细纲。