muse-agent-example/docs/2026-08-20-质量收敛环运行手册.md
zizi 091b66a9bb 重构: 收敛 Agent/Skill 运行时与创作质量闭环
将角色与 Skill 从 .claude 迁入 .agent,移除 Claude CLI 运行时并接入固定 Opus 角色 profile、完整 schema、预算 deadline、raw 与回执证据链。

同步拆分 Skill 职责、复利 lesson、Gate 回放、Dashboard 人审入口、数据库登记和机械门禁;候选设计正文不包含在本提交中。
2026-08-22 02:12:32 +08:00

1.8 KiB
Raw Blame History

质量收敛环运行手册(实验性)

状态:历史实验流程,不是任何 Skill 的现行合同。现行归因入口是 optimize-content-quality(只出建议);评分归 score-content-quality;Gate 终态归 adjudicate-quality-gate。

目标

把某一章(或某类场景)的生成质量收敛到叙事关键三维全部 ≥4.0(专题-04 达标口径;非关键维只出建议),并把「怎么达标的」沉淀成可复用资产。

环(n=5)

  1. 评:派 judge 对候选章打分(结构化报告落库或临时评测目录;不引用不存在的 评审/ 固定路径)。
  2. 诊:取最低两维,归因到 prompt / 上下文 / 设定三层之一(详见 optimize-content-quality 归因表)。
  3. 改:每轮只改一个变量;框架层改动须走正常 Git 流程与用户授权,设定层走 decide-candidate / confirm-knowledge-draft。
  4. 产:重新生成该章(新候选覆盖工作区),回到第 1 步。
  5. 止:叙事关键三维全部 ≥4.0,或连续两轮无提升,或满 5 轮。

收口

  • 达标:样张章文件 + 评分报告 + 当轮 agent prompt 的 git hash 固化到项目约定的金标目录(如 review-knowledge-cards 使用的 golden/ 范式),作为回归基线。
  • 不达标:把卡点(哪一维、试了什么、为什么没用)如实报给用户,不硬凑分数。

纪律

  • 评分必须有引文证据;禁止为了分数让 judge 放水。
  • 同一 rubric 复评分差 >0.5 时先查评委稳定性再查正文。
  • 正文离线 A/B/C 回放不走本环,走 writer_replay profile(见 score-content-quality)。