muse-agent-example/docs/2026-08-20-质量收敛环运行手册.md
zizi 0260bcd8e2 设计文档:SoT 同步与生成物重出
- 新版设计各域 SoT 按本轮实现同步:总体架构、模块设计、接口契约、数据模型、功能规格、文件设计与决策记录。
- 接口契约生成物重新导出(openapi 与前端客户端随契约一致)。
- 实现回顾与专项检查台账保留历史结论;本轮收尾发现另见 .agents.local 下的收尾报告与审查处置。
2026-09-18 01:15:18 +08:00

2.0 KiB
Raw Permalink Blame History

质量收敛环运行手册(实验性)

状态:历史实验流程,不是任何 Skill 的现行合同。现行归因入口是 optimize-content-quality(只出建议);评分归 score-content-quality;Gate 终态归 adjudicate-quality-gate。

目标

把某一章(或某类场景)的生成质量收敛到叙事关键三维全部 ≥4.0(专题-04 达标口径;非关键维只出建议),并把「怎么达标的」沉淀成可复用资产。

环(n=5)

  1. 评:派 judge 对候选章打分(结构化报告落库或临时评测目录;不引用不存在的 评审/ 固定路径)。
  2. 诊:取最低两维,归因到 prompt / 上下文 / 设定三层之一(详见 optimize-content-quality 归因表)。
  3. 改:每轮只改一个变量;框架层改动须走正常 Git 流程与用户授权,设定层走 decide-candidate / confirm-knowledge-draft。
  4. 产:重新生成该章(新候选覆盖工作区),回到第 1 步。
  5. 止:叙事关键三维全部 ≥4.0,或连续两轮无提升,或满 5 轮。

收口

  • 达标:样张章文件 + 评分报告 + 当轮 agent prompt 的 git hash 固化到项目约定的金标目录(如 review-knowledge-cards 使用的 golden/ 范式),作为回归基线。
  • 不达标:把卡点(哪一维、试了什么、为什么没用)如实报给用户,不硬凑分数。

纪律

  • 评分必须有引文证据;禁止为了分数让 judge 放水。
  • 同一 rubric 复评分差 >0.5 时先查评委稳定性再查正文。
  • 正文离线 A/B/C 回放不走本环,走 writer_replay profile(见 score-content-quality)。