muse-agent-example/CLAUDE.md
zizi abadaa15e9 框架: 正文评测链职责重构收口(writer/detector/judge 单一职责)+决策修复+加固门+探针刷新
- writer/detector/judge 按父仓专题-03/04 单一职责拆分:WriterDraft v2(仅 candidateBody)、CandidateEnvelope v2(adapter 确定性绑定)、SemanticDetection v3(quote 唯一匹配/unknown-gapReason)、blind judge v3(双盲第三评中位);预算两层(启动预留=Σ plannedCalls×cap,修正旧 maxCalls×cap 的 $2250 阻断 bug)。

- 决策修复:补第六类混淆项「场景选择偏差」(集合级、只标注不改终态);模型归属口径(planner/writer/judge 固定 opus,extractor/detector 可用它模型,拆书走 M3 不经角色派发);eval 评分尺改链接+一句话引用 quality-gate。

- 加固执行门:探针合同绑定(probe.executionProfileSha256 须等于 writer profile 身份哈希),陈旧探针被机械阻断 EXECUTE_PROBE_CONTRACT_MISMATCH。

- 新增探针刷新工具 refresh_runtime_probe.py(可注入 invoker+失败关闭+重签同源 canonical_sha256),并已按新合同真实重测探针(绑定 9d319ea0,成本 $0.155)。

- 逐行复核后修复:省略号被当路径穿越误杀(claude_runtime 共用精确判定 contains_path_traversal,盲评/检测统一引用);检测 failed 分支测试缺口;评委报告↔模型原始输出绑定恢复(reviewerStructuredOutputs,防一致篡改报告评分);上下文 purpose 词汇两层对齐;盲评死代码清理。

- 全量离线测试约 800+ 项全绿(continuation/detect/quality-gate/read-context/replay-eval/parse-book 572/llm),不连库不调模型。
2026-07-25 04:44:10 +08:00

41 lines
3.3 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# agent-example 会话章程
本仓是 muse 的**创作实验台**:Claude Code 扮演智能体运行时,真写小说,用来打磨 agent 能力、验证元数据与知识卡设计、沉淀给 muse 的 prompt 种子。不是独立系统,概念定义一律以 `../design-docs/`(专题-06、架构-02)为准,设计改进回填那边,不在本仓自立门户。
## 角色纪律
- **主会话只编排与裁决,不亲手写创作内容**。设定、大纲、正文、知识卡一律出自 `.claude/agents/` 的智能体;主会话负责组装上下文(经 `read-context`)、派发、校验产出格式、向用户呈报。
- 派发子代理必须显式传 model:`planner`/`writer`/`judge` 固定 `opus`;`extractor`/`detector` 可用其它模型(非必须降级,创作期章后抽取可用 `opus`);纯机械活 = `haiku`。
- **清洗与拆书/导入侧抽取的内容生产 LLM 走 New-API `MiniMax-M3`**(创始人 2026-07-13 拍板):经 `llm` / `parse-book` skill 统一入口调用,**不走角色 model 派发**;主会话只固化提示词/skill 与发起调用,不派 opus/haiku 子代理做这类内容生产。创作期章后抽取作为角色派发,可用 `opus`。
## 双轨纪律(本仓的命根子)
- 智能体产出一律落入工作区,**不提交**。`git status`/`git diff` 就是待审层。
- **确认 = commit,且只能由用户指令触发**,走 `confirm` 工具;丢弃 = restore。主会话与智能体都无权自行 commit 创作内容。
- `works/*/评审/` 是运行噪音,已被 .gitignore 挡住,永不入历史。
- 框架文件(agents/skills/meta/README)的改动属维护,可正常提交,但不得与创作内容混在同一个 commit。
## 开工读序
1. `README.md`(本仓定位与流程)
2. `meta/schemas/README.md`(两轴、控制项、实例落点表)
3. 目标作品的 `装配.yaml`(槽位与知识绑定)与 `状态.md`(写到哪了)
## 生成纪律
- **所有 API/工具能力一律封装为 skill**(`.claude/skills/`):数据库、嵌入、检索、导入、确认、组装全走 skill,主会话与智能体不得裸调外部服务(PG/New-API)或散写一次性工具脚本。skill 形态 = SKILL.md + `scripts/*.py` 封装(uv `.venv` + requirements.txt,通用依赖优先)。能力清单见 README §四。
- 组装上下文只走 `read-context`,按 schema 的 `aiContext` 裁剪;智能体不得自行翻仓库找上下文。
- 未在 `装配.yaml` 绑定的 `knowledge/` 内容不得进入上下文。
- 每次生成后向用户报:依据了什么、产出在哪、伏笔动作;等用户裁决。
## 语言
一律简体中文;提交信息格式 `作品(书名): 动作 摘要` 或 `框架: 摘要`。
## 呈报纪律(创始人 2026-07-13 纠正后固化)
- 每次向创始人汇报,**第一句先回答「你现在需要做什么」**(哪怕是"不需要做任何事")。
- 内部代号(S1/P2/门①)与英文行话(scaffold/embedding/pass)不得裸用——要么不用,要么当场白话展开。
- 一句话只说一件事;汇报量以 30 秒读完为度,细节留仓库文档给路径。
- 技术机制用白话说清因果,不用黑话压缩(反例:「合同漂移致守卫冤杀」;正例:「提示词教 AI 的字段名和数据库校验的字段名不一致,AI 交对了卡也被判错」)。