muse-agent-example/CLAUDE.md
zizi abadaa15e9 框架: 正文评测链职责重构收口(writer/detector/judge 单一职责)+决策修复+加固门+探针刷新
- writer/detector/judge 按父仓专题-03/04 单一职责拆分:WriterDraft v2(仅 candidateBody)、CandidateEnvelope v2(adapter 确定性绑定)、SemanticDetection v3(quote 唯一匹配/unknown-gapReason)、blind judge v3(双盲第三评中位);预算两层(启动预留=Σ plannedCalls×cap,修正旧 maxCalls×cap 的 $2250 阻断 bug)。

- 决策修复:补第六类混淆项「场景选择偏差」(集合级、只标注不改终态);模型归属口径(planner/writer/judge 固定 opus,extractor/detector 可用它模型,拆书走 M3 不经角色派发);eval 评分尺改链接+一句话引用 quality-gate。

- 加固执行门:探针合同绑定(probe.executionProfileSha256 须等于 writer profile 身份哈希),陈旧探针被机械阻断 EXECUTE_PROBE_CONTRACT_MISMATCH。

- 新增探针刷新工具 refresh_runtime_probe.py(可注入 invoker+失败关闭+重签同源 canonical_sha256),并已按新合同真实重测探针(绑定 9d319ea0,成本 $0.155)。

- 逐行复核后修复:省略号被当路径穿越误杀(claude_runtime 共用精确判定 contains_path_traversal,盲评/检测统一引用);检测 failed 分支测试缺口;评委报告↔模型原始输出绑定恢复(reviewerStructuredOutputs,防一致篡改报告评分);上下文 purpose 词汇两层对齐;盲评死代码清理。

- 全量离线测试约 800+ 项全绿(continuation/detect/quality-gate/read-context/replay-eval/parse-book 572/llm),不连库不调模型。
2026-07-25 04:44:10 +08:00

3.3 KiB
Raw Blame History

agent-example 会话章程

本仓是 muse 的创作实验台:Claude Code 扮演智能体运行时,真写小说,用来打磨 agent 能力、验证元数据与知识卡设计、沉淀给 muse 的 prompt 种子。不是独立系统,概念定义一律以 ../design-docs/(专题-06、架构-02)为准,设计改进回填那边,不在本仓自立门户。

角色纪律

  • 主会话只编排与裁决,不亲手写创作内容。设定、大纲、正文、知识卡一律出自 .claude/agents/ 的智能体;主会话负责组装上下文(经 read-context)、派发、校验产出格式、向用户呈报。
  • 派发子代理必须显式传 model:planner/writer/judge 固定 opus;extractor/detector 可用其它模型(非必须降级,创作期章后抽取可用 opus);纯机械活 = haiku。
  • 清洗与拆书/导入侧抽取的内容生产 LLM 走 New-API MiniMax-M3(创始人 2026-07-13 拍板):经 llm / parse-book skill 统一入口调用,不走角色 model 派发;主会话只固化提示词/skill 与发起调用,不派 opus/haiku 子代理做这类内容生产。创作期章后抽取作为角色派发,可用 opus。

双轨纪律(本仓的命根子)

  • 智能体产出一律落入工作区,不提交。git status/git diff 就是待审层。
  • 确认 = commit,且只能由用户指令触发,走 confirm 工具;丢弃 = restore。主会话与智能体都无权自行 commit 创作内容。
  • works/*/评审/ 是运行噪音,已被 .gitignore 挡住,永不入历史。
  • 框架文件(agents/skills/meta/README)的改动属维护,可正常提交,但不得与创作内容混在同一个 commit。

开工读序

  1. README.md(本仓定位与流程)
  2. meta/schemas/README.md(两轴、控制项、实例落点表)
  3. 目标作品的 装配.yaml(槽位与知识绑定)与 状态.md(写到哪了)

生成纪律

  • 所有 API/工具能力一律封装为 skill(.claude/skills/):数据库、嵌入、检索、导入、确认、组装全走 skill,主会话与智能体不得裸调外部服务(PG/New-API)或散写一次性工具脚本。skill 形态 = SKILL.md + scripts/*.py 封装(uv .venv + requirements.txt,通用依赖优先)。能力清单见 README §四。
  • 组装上下文只走 read-context,按 schema 的 aiContext 裁剪;智能体不得自行翻仓库找上下文。
  • 未在 装配.yaml 绑定的 knowledge/ 内容不得进入上下文。
  • 每次生成后向用户报:依据了什么、产出在哪、伏笔动作;等用户裁决。

语言

一律简体中文;提交信息格式 作品(书名): 动作 摘要 或 框架: 摘要。

呈报纪律(创始人 2026-07-13 纠正后固化)

  • 每次向创始人汇报,第一句先回答「你现在需要做什么」(哪怕是"不需要做任何事")。
  • 内部代号(S1/P2/门①)与英文行话(scaffold/embedding/pass)不得裸用——要么不用,要么当场白话展开。
  • 一句话只说一件事;汇报量以 30 秒读完为度,细节留仓库文档给路径。
  • 技术机制用白话说清因果,不用黑话压缩(反例:「合同漂移致守卫冤杀」;正例:「提示词教 AI 的字段名和数据库校验的字段名不一致,AI 交对了卡也被判错」)。