muse-agent-example —— muse 的创作实验台
- 版本:v3(2026-07-09,路线定版:文件创作台先行,真后端第二步;不再模拟数据库与知识库引擎)
- 仓库:独立 git,remote
ssh://git@101.200.34.71:2222/zizi-al/muse-agent-example.git;本地物理上住在 oh-my-muse/ 下(父仓已 ignore),为的是就近引用 design-docs - 概念权威:一律以
../design-docs/(专题-06、架构-02)为准;这里发现设计不合用,回填那边,不在本仓自立定义
一、定位:不是迷你 muse
Claude Code 在这里只扮演一个角色:智能体运行时——真架构里这个位置本来就是可替换的外部运行时(专题-05 定义的那道缝)。它真写一部小说,验证面就是可读的作品内容。给 muse 沉淀四样东西:
- agent 能力:写作/规划/抽取/检测的 prompt 按天迭代,达标版即未来 muse 智能体配置的种子;
- 元数据设计的实战修订:23 型 schema 在真实创作里用,字段缺什么、哪里别扭,写两章就暴露,改完回填 design-docs 与 W1 种子;
- 知识卡内容设计:知识库不模拟引擎(向量检索已在真环境证成),只打磨内容那一半——卡长什么样、检索回来怎么进上下文;
- (阶段二)真实 API 的使用反馈:哪只缺、哪只难用,即交付物。
二、两阶段
- 阶段一(现在):纯文件 + git,无库无服务。产出可读的小说、schema 修订、达标 prompt。
- 阶段二(创作流稳定后):同一套创作流换接真后端
/app-api(单人版 compose 按主仓 S9 收口已验证可从零起)。真 PG 在 infra、建表即主仓迁移 SQL、全用系统主账号调用——「要真表真 SQL」的要求由真后端天然满足,不拷库。
三、数据规则(三条)
- 人逐行读改的进文件:正文一章一个 md;每作品四个小文件(
设定.md、大纲.md、状态.md、装配.yaml)加一个带索引的知识卡目录。不按段落/场景拆文件。 - 运行噪音进
works/*/评审/:检测报告、评分、上下文包回显都在这,.gitignore 挡住——可看、可复跑、不入历史。 - 待审与确认交给 git:智能体产出一律不提交,
git diff就是候选评审界面;确认 = commit(提交信息带来源),丢弃 = restore;git log天然是采纳台账。
四、目录与能力清单
agent-example/
├── CLAUDE.md ← 会话章程:主会话只编排裁决;确认只能由用户触发
├── .claude/
│ ├── agents/ ← 动脑的:writer / planner / extractor / detector / judge
│ └── skills/ ← 基建 skill(组装/确认/收敛+库/导入/嵌入/检索) + 功能 skill(每 scenario 一只功能合同)
├── meta/schemas/ ← 23 型结构本体设计稿(对齐专题-06;README 有实例落点表)
├── meta/chains/ ← 功能链与功能指令设计稿(prompt 三段式的功能段;G2 治理对象)
├── knowledge/ ← 跨作品层:参考书原文 + 拆书产出的公共范式卡(绑定才进上下文)
└── works/<书名>/
├── 设定.md ← 作品容器+作品核心+世界观总纲+文风画像(四节一文件)
├── 大纲.md 状态.md 装配.yaml
├── manuscript/ ← 正文,一章一个 md,frontmatter 按 chapter/scene 合同
├── 知识/ ← 本作品知识卡:人物/地点/势力/功法体系/物品/事件/关系 + 索引.md
└── 评审/ ← 运行噪音(gitignored)
能力清单(公约:所有 API/工具能力一律封装为 skill,不散写一次性脚本、不裸调外部服务)
skill 两族共 16 只:基建 7(确定性工具能力,每只=未来 muse API 的一道缝;现有 3 + 按闭环步交付 4)+ 功能 9(每 scenario 一只,承载功能细节约束=功能链场景合同,已全部建成)。
| skill | 做什么 | 对应 muse API 面 | 状态 |
|---|---|---|---|
| read-context | 统一读取器:读装配绑定→按用途+aiContext 三级裁剪→组装六分区上下文包→裁剪清单回显 | 统一创作数据读取器(专题-06 §7) | 现有(文件版);C4 升 PG 检索版(内部调 search) |
| confirm | 唯一确认通道:确认=commit、丢弃=restore,仅创始人触发;PG 版加知识行草稿→已确认翻转 | 双轨提交 / 候选三决策入口 | 现有 |
| eval | 质量收敛环:n=5、每轮只动一个变量、达标固化 golden/ |
质量域 | 现有 |
| db | muse-example 唯一数据库通道:psycopg 直连封装(凭据按 db/连接信息.md),查询/DDL/DML/SQL 文件应用全走这,结果卡片式打印(=审查面) |
数据访问层 | 已交付(2026-07-13) |
| import | 导入解析:txt→回目正则静态分章→作品/章行入库(调 db) | 导入解析旅程 | B1 交付;C8 用户旧稿复用 |
| embed | New-API 嵌入封装:Qwen3-Embedding-8B、dimensions:1024、--noproxy、批量+失败重试 |
AI 网关(嵌入) | B2 交付 |
| search | 向量检索:意图→embed→pgvector 相似度召回→授权过滤(仅已确认+已绑定)+字段裁剪→带相似度分的结果集 | 知识检索 | B3 交付 |
| llm | New-API LLM 统一调用入口(默认 MiniMax-M3):trust_env=False、重试、<think> 剥离、JSON 三级容错(json-repair 兜底)、token 用量审计;清洗/拆书等内容生产调用一律经此 |
AI 网关(生成) | 已交付(2026-07-13) |
| clean | LLM 探测+代码执行的正文清洗:M3 每窗(~10万字)只报待删段逐字原文→四道守卫裁决删除→审计入 example_clean_log;源 txt 不动可回滚 | 导入清洗旅程 | P0/P1 已交付(2026-07-13) |
功能 skill ×9(prompt 三段式的功能段;每只必带「元数据驱动」节写明 schema 怎么控制它;链登记表见 meta/chains/README.md):
| 功能 skill | 一句话 |
|---|---|
| continuation / rewrite / expansion / polish | 写作四功能:章结构=chapter/scene 字段合同;改写锁范围+版本核对;扩写只扩内容不加设定;润色只动表达层+逐处清单 |
| planning | 产出结构=schema 字段清单本身;字段全覆盖或标「字段存疑」 |
| parse-book / extract-knowledge | 拆书(判据归型+脱敏红线+设计发现回写)与章后抽取(字段合同=抽取 checklist;冲突不覆盖) |
| detect | 检查清单由 aiContext 含 detection 的字段自动生成,schema 加字段检查项+1 |
| quality-gate | 专题-04 维度体系的单一来源(3 叙事关键定达标线+5 非关键出建议) |
skill 官方规范对齐(2026-07-09 按 code.claude.com/docs 核查):frontmatter name(≤64,小写连字符)+description(≤1024,第三人称,写清做什么+何时用);正文纯 markdown <500 行,附属文件(scripts/reference)从 SKILL.md 单层链接;progressive disclosure 三级(description 常驻 / 正文按调用加载 / 附属按需)。功能 skill 递送给子代理:官方三机制——子代理带 Skill 工具自主调用、frontmatter skills: 启动预加载、skill 侧 context: fork 反向驱动;但 skills: 预加载是"列出的全部注入",与「一次只带本次功能」冲突——定为主会话内联:派发时读 SKILL.md 正文按拼装序塞进功能指令段位,子代理无需 Skill 工具(tools 受限不影响,我们的功能 skill 是纯 markdown 合同、无动态注入语法,内联零损失)。9 只功能 skill 已标 disable-model-invocation: true(防主会话误自动触发、description 不占常驻上下文,/name 手动仍可用)。
skill 形态公约:每只 skill = SKILL.md(何时用+输入输出合同)+ scripts/*.py(封装好的确定性实现)。Python 3.12 + uv 管理的 .venv,依赖清单 requirements.txt(psycopg[binary] / requests / pyyaml / click),多用通用依赖不造轮子;PG 经 psycopg 直连(连通事实与凭据见 db/连接信息.md),New-API 调用禁系统代理(trust_env=False);脚本失败原样报错不静默。现有三只流程型 skill(read-context/confirm/eval)以流程管控为主,涉库涉外步骤在 PG 版升级时同样下沉进脚本。
agent = 动脑的(LLM 判断力,达标 prompt 即未来 agent_version.config 种子)——共 5 个,全 opus,与 专题-06 §3 智能体三层清单 一一对应、无自造型:第一层开放槽位件 4 + 第二层保护节点件 1。
| agent | SoT 身份(专题-06 §3 / 专题-03 §2.3) | 做什么 | 用在 |
|---|---|---|---|
| writer | 一层 · 写作(Writing 槽位) | 整章正文候选:2500–3500 字、AI 味黑名单零命中、新设定申报注释块;只进待审 | C4 |
| planner | 一层 · 规划(规划链槽位) | 设定包/大纲/细纲候选;字段全覆盖或标「字段存疑」;未确认不进后续生成上下文 | C2 |
| extractor | 一层 · 拆书/分析(Analysis 槽位) | 两用场:拆书(B2,按库内 schema 产知识行草稿+出处链;系统级只产抽象范式、不留原文)与章后抽取(C5);冲突标「⚠ 冲突待裁决」不覆盖 | B2 / C5 |
| detector | 一层 · 检测(Detection 槽位) | 一致性/伏笔/设定违背检查,只产解释与定位落 评审/,不改正文与知识 |
C4 伴随 |
| judge | 二层 · 保护节点(质量门控与 LLM-Judge)——不可被装配替换,即 G2 判据的活体 | 按专题-04 §4 维度体系评分:3 叙事关键(定达标线,全部 ≥4.0 过门)+5 非关键(只出建议),引文证据制 | C6 / eval 内 |
SoT 第三层「知识基座」(检索/切块/入库,明文不是 app)在实验里即 skill 层(db/import/embed/search)——正好印证「所有 API/工具皆 skill」。分工判据:需要 LLM 判断的进 agent;确定性的取数、写库、外部调用、流程管控进 skill;LLM 参与但属主权裁决的落保护节点(不开放装配)。agent 只经 skill 拿上下文与落库。
prompt 三段式(登记表见 meta/chains/README.md):身份段(agent .md,跨功能共享)× 功能指令段(功能 skill,每 scenario 一只,派发只加载本次一只)× L0 任务特化——不做一个 agent 一个大 prompt(防指令稀释),也不按功能裂 agent(防身份复制)。skill 辅助映射:extractor 最重(db 读 schema 与既有知识、产出经 db 写入 draft、embed 嵌入);writer/planner/detector 经 read-context 取数、PG 版加 search 召回;judge 零外部依赖(基线包+rubric);import 是纯确定性工具,LLM 不参与。
LLM 能力功能全覆盖对照(SoT 功能 → 实验落点,防漏配):写作 7 功能(续写/改写/扩写/润色/纠错/去AI味/角色声音)→writer;规划 5 动作(生成/补全/整理/检查/多方案,产品-03 §3.5)→planner;分析 6 功能(目标分析/实体解析/候选草稿提取/全书解析/章节抽取/结构拆解)→extractor;检测 5 检查(风险/一致性/角色声音/文风/语义偏离)→detector;质量评分 8 维(专题-04:3 叙事关键+5 非关键)→judge;有限重写(≤2 次,专题-04 §5)→eval 环承担(judge 诊断+writer 重生成,人在环);合规与语义围栏→不镜像(阶段一由平台安全层承担,阶段二真后端承接);组装内摘要化(超预算先摘要低层)→read-context 流程内动作;嵌入/重排→embed/search skill(第三层模型能力,非 agent);硬阻断 3 维(来源安全/输出合规/静态结构)→规则层检查,skill/流程承担,不进评委职权。
上下文组装结构(SoT=专题-03 §4 四层上下文 + 专题-06 §7 统一读取器;操作细节以 read-context skill 为准)
四层上下文(专题-03 §4.2;请求带 scenario 用途与授权语义)
├── Layer 0 当前输入 任务目标+本章细纲+当前文本 ——不可省略
├── Layer 1 近邻正文 上一章末尾场景原文+再前一章摘要+近期叙事状态 ——续写不可省略
├── Layer 2 作品事实 设定四节+正式规划+状态台账+知识卡(仅出场+关联) ——只读已确认(Canonical)
└── Layer 3 授权资料 绑定的公共范式库/全局知识 ——按场景可省;必须有绑定授权
预算顺序:先留输出预算 → L0 完整保留 → L1 优先 L2 优先 L3;超限先摘要化低层再截断
拼装顺序(物理序,与预算序是两回事,按稳定度递减):
通用系统位(全 agent 相同) → 章级基线包(L2+L1+L0稳,按 writer 视图组装,跨 agent 共享缓存)
→ agent 身份段(角色指令后置) → 功能指令段(本次 scenario 的功能 skill)
→ agent 增量段(底牌/全集/rubric/L3 检索结果,只加不减) → L0易变部(用户本回合意图,绝对尾置)
——同章流水线 writer 首跑写缓存,后续 agent 按 1/10 价读;基线=writer 视图锁"无人多看",
增量只加锁"无人少看";阶段一子代理机制钉系统位不落此布局,阶段二 Context Assembly 落
裁剪回显(落 评审/,验收证据):字段级=aiContext 裁剪清单(专题-06 §7)
+ 来源级=omittedSources(原因枚举:token_budget/not_authorized/stale_source/low_confidence/not_relevant/blocked)
文件版落位:设定/大纲/状态/知识卡→L2,正文近邻→L1,装配绑定的公共范式→L3,派发指令与细纲→L0。三级裁剪=字段级 aiContext / 来源级 装配绑定 / 用途级 scenario。PG 版只改 L2/L3 取数方式(search 召回+授权过滤),层结构与回显合同不变。
按 agent 差异(骨架不变,差异=字段可见集×每层取数范围×层必省性;完整矩阵在 read-context skill):writer 防剧透(底牌全闭、仅出场卡);planner 看全局(唯一底牌全开+未来粗纲);extractor 忠于原文(待拆章全文是处理对象、L3 关闭防诱导脑补);detector 持有基准(知识全集+底牌开,专查提前泄底);judge 同证独立(可见面=writer 基线不多不少、L3 关闭防拿范式放水)。矩阵为实验设计稿,验证后回填专题-03 §4。
五、一次续写怎么走
- 主会话读
装配.yaml(写作槽位绑了哪个写手、绑定了哪些公共库); - 走
read-context组装上下文:设定与知识卡按 schema 的aiContext裁剪(如「结局方向」续写时不给)、近两章正文尾部、状态.md、本章细纲;被裁掉的字段记入回显,落评审/; - 写手产出整章,直接写进
manuscript/新章文件——不提交; - 检测/评委只读产出报告与评分,落
评审/; - 你读章 + 看报告:满意 → 走
confirmcommit;要改 → 提意见重生成;不要 → restore; - 确认后抽取员按 schema 从新章抽新实体/事件 → 知识卡(状态:草稿)落
知识/,与既有卡冲突时标冲突留你裁决;下次续写即可被读取器用上。
「角色卡长什么样」由 schema 声明——加一个字段,抽取与生成的产出立刻多这个字段,智能体一行不改;换绑写手只改 装配.yaml。这两条是「元数据驱动」的活体证明(场景 A7 专门验收)。
六、schema 设计稿公约
- 型名、两轴(domain×scope)、判据与专题-06 §4 严格对齐;字段是本仓先行草拟的实战设计稿(SoT 尚未给出逐型字段合同的部分由这里试出来)。
- 实战中的字段增删、判据修正 → 回填 design-docs 与 W1 种子后,在 schema 文件里标注「已回填@日期」。本仓不是字段定义的长期 SoT。
- 作品级扩展走
装配.yaml的「作品级扩展字段」,只增不改(对齐 base/override 机制)。
七、产品场景台账(对齐 产品-03,实验按真实产品旅程推进)
实验不走自造场景序,按 muse 的产品旅程走:管理员治理旅程(产品-03 §4)先备能力与全局资产,普通用户旅程(§2.2/§3 no-config 主线 + 增强路径)走创作闭环。市场、计费、个人中心不镜像,阶段二真后端承接。
管理线(管理员控制台旅程)
| # | 产品场景(SoT 锚) | 实验落法 | 判据锚 |
|---|---|---|---|
| G1 | 元结构治理:base schema 发布(§4.2) | meta/schemas/ 23 型种子与字段合同,发布=框架 commit |
字段全覆盖;发现回写「设计发现」 |
| G2 | 系统能力治理:功能链/槽位/默认件(§4.3) | 四槽位默认智能体 + read-context 保护流程 + confirm 封闭入口 | 保护节点不可被装配替换 |
| G3 | 全局知识治理:系统级拆书→授权(§4.4) | 参考书导入→拆书范式卡(草稿)→管理员确认(=commit)→作品侧凭绑定使用 | 范式卡脱敏带出处;未确认不授权 |
用户线(no-config 主路径 + 增强路径)
| # | 产品场景(SoT 锚) | 实验落法 | 判据锚 |
|---|---|---|---|
| U1 | 我的作品:新建作品(§3.2) | works/<书>/ 容器就位 |
容器合 novel_work 合同;确认随 U2 一并 commit |
| U2 | 规划旅程:候选→用户确认→正式规划(§3.5) | 设定包+大纲候选(未提交)→ 用户确认 | 未确认规划不进生成上下文 |
| U3 | AI 候选旅程:三决策(§3.4) | 续写候选 + 上下文回显 → 原样接受 / 修改后合并 / 丢弃 | 回显含裁剪清单;决策前 Canonical 零变化 |
| U4 | 知识确认旅程(§3.6) | 采纳后抽取→草稿→自动确认(自有正文+无冲突)/ 冲突入待确认队列 | 采纳正文≠确认知识;冲突必人工 |
| U5 | 增强·知识库绑定(§6.3) | 装配.yaml 绑 knowledge/范式/,用户确认生效 |
绑定≠写入;解绑即从上下文消失 |
| U6 | 增强·槽位替换(§5.3) | 换绑写手件,证「元数据驱动」 | 链与流程零改动,产出风格切换 |
| U7 | 导入解析旅程(§3.7) | 导入旧稿→解析分章→逐章审阅确认→知识草稿 | 解析结果先入待审;确认按章 |
| U8 | 导出交付(§3.8) | 编译全书正文+设定导出 | 导出走确认后内容,含来源标注 |
| — | 质量收敛(伴随 U3 循环,专题-04 简化) | judge 按专题-04 维度评分 + eval n=5 收敛,达标固化 golden/ |
评分有引文证据;叙事关键三维 ≥4.0 达标 |
产品红线原样生效:候选决策只有三类(原样接受/修改后合并/丢弃);采纳正文≠确认知识;未确认规划不进生成上下文;绑定≠写入;保护节点不可替换(§1.1-12)。
完整闭环执行序(对齐稿 v2,2026-07-09,待创始人拍板)
创始人已拍:知识域先行(PG+向量插件为基座、以可见知识库数据为审查)、创作域后置。完整闭环 = 四阶段三回路:作品内环(生成→章后抽取→知识回库→供下一章)、元数据环(拆书/创作暴露的字段问题→修订 schema 种子→产出立刻变)、设计环(发现回填 design-docs 与 W1 种子)。
flowchart LR
A[A 基座与元结构<br>建库·表映射·schema种子入库] --> B[B 全局知识生产<br>导入分章→拆书→检索→优化环]
B --> G{B5 管理员确认+授权门}
G --> C[C 创作域<br>建作→规划→绑定→续写三决策→导出]
C -->|章后抽取→知识确认→回库| C
B & C -->|字段/判据修订| A
B & C -->|设计发现| D[D 回填design-docs<br>+阶段二换接真后端]
阶段A 基座与元结构(管理线 G1/G2)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| A1(原K0) | 基座 | muse-example 建库+vector 插件;嵌入通道已实测(Qwen3-8B 默认 4096、dimensions:1024 生效) |
psql 实测输出 | 未做,第一步 |
| A2(原K1) | 库表映射 | 主仓 sql/muse 摘录一致 DDL(meta / work·chapter / knowledge 三域)→应用;实验私货全进 example_* 前缀(嵌入边表 vector(1024)、tenant/creator 默认系统主账号=1);交付 db 查询 skill |
\dt + 表↔主仓迁移来源映射 |
未做 |
| A3(原K2) | G1 元结构治理 | 23 型 YAML → meta 表行(=W1 种子演练);此后拆书/抽取一律读库内 schema | schema/字段行卡片打印 | ✅ 已收口(2026-07-13):23 型/294 字段行,字段级 aiContext 入 policy_snapshot;seed_schemas.py 幂等 |
| A4 | G2 系统能力治理 | 四槽位默认智能体(身份段)+ 功能 skill ×9 + 功能链登记表(meta/chains/)+ read-context/confirm/eval 保护流程 |
保护节点不可被装配替换 | 已就位(文件侧);装配入库随阶段二 |
阶段B 全局知识生产(管理线 G3 主体;审查=可见知识库数据)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| B1(原K3) | 参考书导入+静态分章 | import 工具(回目正则)→ 8 本全本作品/章/块入库 | 作品/章行数对账+quality_report 基础面报告 | ✅ 基本收口(2026-07-13):8 本 ≈1.18 万章全入库;机战无限/超神机械师因源损坏格式(区间章号/分页尾巴/残破实体)用修复后解析器重导 |
| B2(原K4) | 拆书智能体 PG 版 | extractor 走 parse-book 2b:先逐章逆推细纲+抽实体作脚手架,再在其上按库内 schema 拆范式→知识行(draft)+嵌入 | 脚手架(细纲/实体)+知识行卡片打印+分型统计+出处链 | 文件版首轮流程已验(产物已清理,字段发现存 schema);PG 版从零起拆 |
| B3(原K5) | 检索验证 | 创作意图→相似度召回;授权与 aiContext 裁剪落查询层 | 检索结果+相关性人工评 | 未做 |
| B4(原K6) | 联合优化环 | prompt × schema 字段 × 知识行质量,n=5 收敛 | 迭代前后对比+设计发现清单 | 未做 |
| B5 | G3 确认+授权门 | 管理员确认(状态草稿→已确认,=commit)→开放作品侧绑定 | 已确认行清单/授权台账 | 无存量,待 B2 产出 |
阶段C 创作域(用户线 no-config 主线+增强;创始人已拍后置,B5 过门后启动)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| C1 | U1 新建作品 | 作品实体入库(新作) | 作品行合 novel_work 合同 | 未做 |
| C2 | U2 规划确认 | 设定包+大纲候选→用户确认→正式规划 | 未确认规划不进生成上下文 | 未做 |
| C3 | U5 绑定全局库 | 装配绑定已确认范式库,确认生效 | 绑定行;解绑即从上下文消失 | 未做 |
| C4 | U3 续写三决策 | read-context 升 PG 检索版→候选→原样接受/修改后合并/丢弃 | 回显含裁剪清单;决策前 Canonical 零变化 | 未做(文件版流程已演练,产物已清理) |
| C5 | U4 知识确认旅程 | 章后抽取→草稿→自动确认(自有正文+无冲突)/冲突入待确认队列;新知识回库供下一章=作品内环闭合 | 采纳正文≠确认知识;冲突必人工 | 未做 |
| C6 | 质量收敛(伴随 C4) | judge 按专题-04 维度+eval n=5,达标固化 golden/ |
引文证据;叙事关键三维 ≥4.0 达标 | 未做 |
| C7 | U6 槽位替换 | 换绑写手件,链与流程零改动 | 产出风格切换=元数据驱动活证 | 未做 |
| C8 | U7 用户导入解析 | 用户旧稿导入(复用 B1 工具)→逐章审阅确认→知识草稿 | 解析先入待审;确认按章 | 未做 |
| C9 | U8 导出交付 | 编译全书正文+设定导出 | 只含确认后内容,带来源标注 | 未做 |
阶段D 回填与换接(伴随各阶段,期末收口审计)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| D1 | 设计环收口 | 设计发现回填 design-docs(专题-06/后端-04/W1 种子),本仓 schema 标「已回填@日期」 | 回填 commit 清单+两侧对读 | 9 条发现已归档在 schema 文件,未回填 |
| D2 | 阶段二换接 | 同一创作流换接真后端 /app-api;沉淀 API 缺口清单 |
缺口清单 | 未启动 |
待拍板(①已拍):① 已拍 A@2026-07-09——B2 首轮公共面只拆 5 型范式,双层型(人物原型等)待脚手架数据可见后二轮决策;② 封神演义导入与拆书范围(决策中);③ A2 口径=主仓表原样不改列、私货全进 example_*;④ 本闭环序整体确认——确认即从 A1 起跑,B5 前每阶段收口报一行。
八、给 muse 的产出物清单
达标 prompt(→ 未来 agent_version.config 种子);schema 修订(→ 专题-06/后端-04/W1 种子);知识卡样式与上下文组装打法(→ 统一读取器 API 设计参考);golden/ 样张与质量基线(→ 完整工程同场景对拍);阶段二的 API 缺口清单。
九、当前位置(2026-07-13 快照)
执行态速览(compact 后从此恢复;细节看 git log 与库内状态表)
- A 阶段全收口:muse-example 库+pgvector 0.8.5(容器重建恢复命令见
db/连接信息.md);24 表(主仓一致 20+example_* 5,含 92-清洗日志表;映射见db/表映射.md);23 型 schema 入库(294 字段行,字段级 aiContext 在 visibility_policy.policy_snapshot)。 - B1 基本收口:8 本参考书全本入库(希泊尼战纪1496 / 星环使命1722 / 机动风暴673 / 机武风暴686 / 机破星河2250 / 深空之影594 / 超神机械师 / 机战无限2901 章;星环使命为创始人 2026-07-13 新增)。源损坏修复经历:双章区间号「第2373-2374章」、分页尾巴「(第1/1页)」、残破实体「&bp;」、纯中文数字章题+重贴+目录页(机动风暴)——全部进 import 解析器规则。基础面验收工具=
quality_report.py(字数/分章/章题/段落/垃圾嫌疑扫描)。 - M3 拍板(2026-07-13 创始人):清洗与拆书的内容生产 LLM 全部改走 New-API
MiniMax-M3(llm skill 统一入口,密钥入仓);主会话(Fable5)只固化 agent/提示词/skill 与发起调用。清洗范围=所有书;删除前创始人质检样张(门①);拆书先不放量(试拆 M3 重做后质检=门②,B2 硬停等新指令)。执行计划:docs/2026-07-13-M3清洗拆书执行计划.md。 - 清洗 P0/P1 收口(2026-07-13):llm skill(M3 入口+json-repair 三级容错)+ clean_detect(每窗一调、断点续跑)+ clean_apply 四道守卫(长度界/章题/单章20%顶/行级垃圾特征拆行——盗版源把广告插进正文句中,M3 会拼「广告+截断正文」,已实测拦住)+ 三级匹配(精确/空白弹性/邻章±1)。实测定标:M3 中文 0.58 token/字,10 万字窗 in≈5.9 万 token 耗时 24s;全语料 ≈340 调用/~19M token。机破星河前 50 章演示已备:40 段/2,188 字待删(dry-run),误删 0。
- opus 试拆基准(workflow 已完成):机动风暴 1–3 章,范式卡 2 张入库(ch2/ch3 各 1 拒 1 越合同)+ch1 脚手架;opus 也犯 JSON 中文引号/缺逗号病(已被 llm skill 容错吸收)。此产物只作 M3 对比基准,不算正式拆书。
- P2 全语料清洗收口(2026-07-13):8 书全清(门①创始人放行)——总删 1,685 段/约 6.1 万字(机破星河 2.4 万/机战无限 1.9 万/超神 0.6 万…),审计全在 example_clean_log(批次 P2-20260713 主删 + fix/fix2/fix3 补删 + P2-sweep 高频水印收割),全库空行归一 8,786 章。守卫体系放量长成:行级垃圾特征+书名豁免+水印裁剪+20%顶带下限+敏感窗备选模型降级(见 clean/SKILL.md)。误删实测 1 例 3 字已修复。已知残留待拍:机动风暴「重贴章题+(第N更 求月票)」嵌正文行变体(求票嫌疑 270 处主源)、感言/请假条整章、作者疲劳话散句。
- B2 试拆收口(2026-07-13,门②已呈报):5 本×前 3 章 M3 直调完成——scaffold 15/15 全过(绝对字数上限+压缩重试对症后,细纲 2.9%–7.8%);范式卡三轮迭代后活卡 19 张(样张
docs/试拆-门②样张.md,opus 同章基准docs/试拆-opus基准-机动风暴.md)。M3 三病理已档:①归型偏科——内容有型区分但 type 一律标 craft,prompt 两轮矫正无效,字段指纹改型又被「串型混填」挫败(一卡混两型字段);②重跑自噬——判重名录含本章旧卡+幂等软删+LLM 随机性组合损耗(已修:名录排除本章+0 卡不软删);③偶发脱敏违规/source 偷懒(守卫拦对+机械回填治)。 - 拆书流程增补(2026-07-13 创始人拍板+落地):①窗级大纲聚合——大纲不从单章抽(单章对大纲层可能零贡献),5–10 万字窗(多章细纲+正文)聚合一次,整本完后拿全体细纲终检(parse_outline.py + 93 表);②三角色审核常设步骤——番茄作家/起点作家/主编审核公共卡(成立性/AI 可用性/可参考性),M3 执行(review-cards skill);fable/opus 只做起量前校准+起量后总审核。校准已过:opus 三评审金标准入 golden/,M3 对照平均绝对偏差 0.45(合格线 0.5),四大系统病独立复现。首批 19 卡 M3 判定 pass 5 / revise 10 / reject 4。
- 金标准评审结论(拆书 prompt 的 B4 改造清单,见 review-cards/SKILL.md):同功 family 撞车(19 卡实为 10–12 个独立技法)、命名黑话+专名泄漏、伪精确数字、伏笔框架硬套场景手法、失败模式才是干货位、采样偏科开局——七条改进已档,B4 环实施。
- B4 收敛环(2026-07-13 创始人拍板「先收敛质量」,S1-S4 全部完成):fable 独立审查完成(报告=
docs/2026-07-13-B4-fable独立审查报告.md,S1-S6 实施序)。头号发现=CONTRACTS 漂移冤案:parse_llm 手写合同与库内字段名漂移,M3 正确产出的 11 张非 craft 卡全被守卫冤杀——「craft 偏科」一半是冤案。已完成:S1 修地基(合同库内动态渲染 prompt 与守卫同源+system 角色分离+审核 idx 匹配;验证=重跑 15 章拒卡 14→0、scene_pattern 首次存活 8 张);S2 schema 批(craft 双模板「装置形态」条件必填禁填+装置类型闭合枚举判定测试+原理/触发条件/读者收益/回收点/记忆维持/滥用反例/迁移用例新字段+emotion 目标情绪+pacing 启用 8 字段「黄金三章画像/开局策略/上架节奏切换/张力曲线/爽点间隔…」=创始人抽取分层议题的书级归属;ingest 三守卫已验);S4 审核环(CRITERIA#8 场景走位+机械降档回测零误伤+分页 ≤30+豁免区说明防假阳);S3 管线重构(本轮完成并验收)——见下条。待做:S5 参数 A/B(范式线 temp 0.2vs1.0;M3 输出方差的根治口)→S6 pacing 书级抽取(等整本拆完)。 - S3 管线重构收口(2026-07-13,验收报告=
docs/2026-07-13-S3窗级出卡验收报告.md):出卡权上移窗级——章级只产「范式候选线索」(并入 scaffold pass,正文只过一遍,放量每书省 ~8M 输入 token),窗级(=大纲窗行,幂等键改 from_order+书末残窗必成窗)聚类归并出母卡+多实例章号,间隔章数由实例章号差机械计算(伪精确灭绝),入库前嵌入判重(≥0.85→M3 归并终判,0.75-0.85 标记)。验收(5 书×3 章重拆对比):型偏科痊愈(craft 27/32→14/39,trope 0→15);命名全短名;摘要通用化;间隔全机械溯源;跨书近亲 3 对被判重标记;审核 pass 11/39,top 4.33×2 超旧金标准最高 4.0。本轮实战修四病(各带机械防线,见验收报告):纪律措辞串型→裁剪降级;占位符字面抄写→机械检测+拒卡重试环;M3 输出方差(同料 0 卡vs10 卡)→0 卡可疑重试;审核豁免区假阳→CRITERIA 补说明。管线定版=五步(chapters→window→cards→check→review,SKILL.md §放量全流程)。 - 抽取窗口×型映射(创始人议题定版):单章=6 实体型+范式候选 hint;窗级(5-10万字)=五型出卡聚类+trope+character_relation;书级=pacing/style/终检。原理:抽取窗口必须 ≥ 该型判据的证成窗口(trope 判据是跨章公式却曾在单章抽=永远证不成)。
- B2 放量首批收口(2026-07-13 创始人拍板放量):5 书×前 50 章跑通五步管线——216 张活卡,审核 pass 123/revise 81/reject 12(pass 率 57%,验收批 2 倍),顶卡 5.0 满分(「小动作验真」四跨章实例三角色全五分);五型首次全活(emotion/combat 在 50 章窗首次出卡);多实例卡 98 张。样张=
docs/2026-07-13-B2放量-5书50章-216卡样张.md。放量首日抓出并根治三轮病(全带机械防线,均已提交):①usage 嵌套 dict 合并崩溃+实体坏行陪葬整章+窗行占位陷阱(换窗参数必先清窗行,入 SKILL.md);②M3 百条线索全型聚类=认知超载退化为逐条转写(37 章窗曾出 74 卡/42 卡整批丢实例键)——治=出卡按型分批(每批一型线索+该型合同,聚类真实发生,压缩比 4:1);③软删延后到确有新卡通过(防新卡全拒时旧卡净损失——星环曾净丢 8 卡)。教训:在飞任务期间不改共享脚本(超神曾读到半成品代码崩溃)。 - B2 全本拆书·限流分批(2026-07-14 创始人拍板:暂停→分批,每批 ≤3000 次请求、批间隔 5 小时):首夜 5 路并行拆至 425–544/书(合计 ~2570 章落库)后按指令暂停。限流纪律:请求含重试保守全计,每批按 ~2700 章排(章级=每章 1 次调用+少量病症重试;窗级出卡=每窗 5–8 次);批间隔 ≥5 小时,宁晚勿早。批1 定时失败→09:09 脱离补跑:sleep 18000 定时挂在 Claude Code 后台任务上,上会话退出被带走→06:40 未开跑、零请求(额度未亏);改 nohup+disown 脱离会话补跑五路(深空→594/机动→673/超神→1455/星环→1722/机战→827,共 2700 章,断点续跑跳已完成章,日志 /tmp/muse-b1-*.log)。跨会话根因未除:本地后台长任务随 Claude Code 会话消亡,彻底可靠需放 mini-desktop tmux/nohup(待定);
pkill -f parse_llm模式串会连带杀定时器。批2=机战章级收口(→2901)+四书窗大纲续切+余量开出卡;批3+=出卡/终检/审核/样张,每批开跑前按预算精排。shell 教训:定时批命令A && B & C &中 C 不等 A(&分组陷阱),必须A && { B & C & wait; }——首挂曾致 4 书抢跑约 1 分钟,当场杀掉,烧个位数请求。章级完成后的续跑序:窗大纲续切(window --to 末章——机动已有 win1-37/深空 win1-36/其余至 50,续跑自动从缺口接;换窗参数才需清窗行)→ 分型出卡cards --redo 不带(断点续跑跳已出窗)→check终检 →review审核 →export样张呈报。 - B2 停跑·缓存与敏感优化前置(2026-07-14 创始人拍板):创始人点破限次数是果不是因——每次请求 token 太贵→同配额可用次数缩水→被迫连砍额度(4000→3000→1000→500);省 token=省次数一根链,先前把两者当并列选项是错判。停跑时批2实发280(机动16/深空43/超神81/星环67/机战73),其中66次(23%)被上游内容安全 new_sensitive(1026) 拦截空耗(机动/星环暴力战争情节,每敏感章重试3次)。双重漏水:①缓存没吃到(scaffold_prompt/window_cards_prompt 把 title/章号/cap/batch_note 变量前置,破坏 read-context 规定的"稳定度递减吃前缀缓存")②敏感空耗23%。优化落地前不重启批次,三前置(均省次数):①缓存重排(固定规则前置、正文/章号/大纲尾置;窗级合同+金标准纪律上千字是最大靶,拆书自拼消息不受"阶段一子代理不能共享缓存"豁免)②拆书补敏感换模型/跳过机制(清洗侧已有先例)③读 token 明细验 M3+New-API 真支持缓存(usage 带 *_tokens_details 疑含 cached_tokens,需1次诊断)。方案待出给创始人。
- B2 优化落地·批3重启(2026-07-14 实测纠正预判):①真凶是前文实体膨胀,不是缓存——章级 prompt 把前文实体全档(型+名+摘要)累积重发,深空557章2851实体≈15万token/章占输入97%、随章号雪崩;缓存只缓存"每次一样的固定前缀"、救不了每章都变的实体清单,此路错判。②压缩(主力):实体索引全档json→名字清单(判重只需名字),每章16万→2万token砍86%(深空500实测14万→1.95万,细纲/实体/线索质量正常),同预算次数×7-8,直达创始人目标2-3000。③缓存诊断:M3经New-API自动缓存恒命中128token(其内部模板,与我方内容无关);换 Anthropic /v1/messages+cache_control 仍 cache_creation=0(M3上游不支持显式缓存);M2.7/deepseek=0——要吃缓存须换模型,但压缩后缓存仅省固定前缀1k小头,不值当;提示词已缓存重排(固定前置)备将来换模型。④敏感降级链:撞 new_sensitive→MiniMax-M2.7→deepseek-v4-flash→全失败硬停,实测 M2.7 救回深空/机动密集敏感章(深空连测3章皆敏感)。批3=500次自停闸(wrapper PID精确kill+计数 grep [llm]|[敏感] 含敏感失败请求防超支,哨兵盯收尾)。教训:创始人两次纠偏单一归因(省钱=省次数是一根链;缓存/压缩/检索是多重方向非二选一)。检索召回(名字清单再压)留后续。
- 批9b 终检收官+样张走查治理(2026-07-16 午前):五书窗大纲终检 100% 收官,blocked=0——compact 前的"STOP 终检完成"实为假收官:check 命令裸用 chat 无敏感降级,超神窗20/星环窗22/机战窗65 撞 new_sensitive 直接崩进程,三书共 134 窗漏检;修复=check 接 chat_degrade 降级链+断点续跑(跳已检窗)+单窗全链拦截标 blocked 跳窗不崩(commit
74989af),补跑 134 窗全过(敏感降级救回 14 次,blocked 0)。样张走查揪出三病并根治:①升格卡尾部 JSON 拼接残渣 59 处+中缝断片(李锋等 20 张头部大卡,条目尾挂 ",/'] 等符号)——机动已清洗归零,守卫 _strip_tail 固化进 merge 追加/立卡/覆写三处,体检加红线 2 条(尾残渣/前缀重复);②前缀重复追加 36 处(模型把旧条目整段抄回再加尾巴,A 是 B 严格前缀→删 A 保超集)——机动清洗 13 处,深空 44 处待接力收官后由 /tmp/muse-debris-w8.sh 串行钩子自动清(整行写回不能与摘要重刷并发);③5 张连号 emotion 卡"读者会Z:"批量乱码定点修复。体检又抓深空窗洞 523-530(B 路补切时漏切)——补切 win46-48(含 530 单章窗)+补出卡+补终检闭环。样张导出固化 parse_export.py(export-patterns 每书每型实例数 top1+combat 加倍供拍板/export-upgrade 出场章 top8+各型代表),两份终态样张已入库:docs/2026-07-16-批9终态样张-范式五书.md(全库 7026 卡:星环1525/机动780/机战2336/深空944/超神1441)+-升格机动.md(559 卡,残渣清洗后重导)。review 全量审核装不下剩余额度(范式 7026 卡×每卡一审≈7000 次)——列入总验收拍板项。 - 批8-9 终态治理+全自动收尾(2026-07-16,compact恢复锚点):批8(闸5700=批7+追加1000)+批9(闸7700=+追加2000,"continue,2000")。里程碑:五书范式出卡全部收官(星环/机动/机战/超神/深空,深空窗大纲尾部353-594由B路自动补切,末窗593-594入库确认)。串行铁律定版(创始人2026-07-15拍板,勿回退):升格窗失败=当场撤销半写入+同窗重试1次,仍败停书断点续跑,严禁跳窗后补(断层+覆盖风险);曾跳窗的深空回滚窗12-38重跑;机动补跑倒流覆写44处按audit最高窗还原+迟到覆写弃用闸+水位GREATEST。三轮找-修-优化:①机械体检6项(三书窗洞51章断点悬空系统性成因→补切9窗+补出卡闭环;星环#1593漏章;新天枢号1723/1895漏并;林初雨垃圾)②opus范式终检(星环1526/机战2319,实例锚定20/20全对,四型80%达标;82卡专名清洗70改8免/同名3对消歧/判重失败5张重判4并1留;combat型210卡题材绑定待创始人拍板:打标签(我方建议)vs改写泛化)③fable升格复验(机械10项:100引号变体去重/15分隔符拆分/果子摘要幻觉更正/安吉儿身份串写回退/萨马奥633章更正/431僵尸水位行;LLM批:安吉儿窗72-80缺口回填/200张character卡死活校验更正12张幻觉摘要——死活类幻觉毒性最高,方法论:机械grep死亡词±60字候选→LLM批判)。管线固化(勿回退,commit 0892bca..073c351):merge 8处守卫/体检脚本parse_health.py(四层+五红线)/切窗缝隙自检/IP词表含词形边界注释(浮游炮平反)/undo清水位/立卡路守卫(初卡字段同过拆分+垃圾拦截)/前缀正则宽至12字符/更新批缺键宽容。机动561卡治理完备(机械清洗+摘要重刷559/561)。五红线终扫全绿。compact时在跑(nohup脱离会话,勿重启):深空升格92+/116(/tmp/muse-b7-upgrade.log)+接力钩子/tmp/muse-w8-relay.sh(升格收官→自动跑/tmp/muse-clean-w8.py机械清洗→/tmp/muse-resummary-w8.py摘要重刷,日志/tmp/muse-b7-resummary.log)+守护闸/tmp/muse-b9-guard.sh(7700,全线自然完成→自动五书check终检/tmp/muse-b7-check.log→STOP行落/tmp/muse-b7-cards-main.log)+五书check因B路收官空档已提前开跑(窗大纲已定型,时点无害)。compact时计数~5720/7700。新会话恢复:查STOP行+接力游标(/tmp/muse-b7-upgrade.log尾"[接力]"行);全完后续跑序=review审核→export范式样张+升格样张(机动/深空)→总验收呈报(含combat拍板项+额度实耗)。待创始人:样张过目/B3检索验证/B5确认门/combat处置拍板。
- 批6-7 全线放量+质量闭环(2026-07-15,compact恢复锚点):批6(2400闸→1211章,敏感救回423,超神/星环/机战大步收口)。批7(创始人放量5000,中途令牌余额见底403中断→充值恢复):章级 7344/7345 收官(顽固59章分段抢救救回57、感言章#97/坏章#811诚实标注入库;唯一余量见库);fable5抽检(事实4.4/合同3.8/生长2.8/归并4.0,判"需修后再放量")→4高2中全修+两轮存量回洗(前缀去重/出场章全书重扫重建312卡/关系落点统一57卡/覆写回退拦截/越合同key裁剪38处/别名准入);定点修复7调用全过(4卡audit旧值合并/黄蜂针净化剥雷行天下/泰加+白色游魂2对并卡)。关键机制修复(勿回退):max_tokens=512000(创始人拍板不设限;New-API按max_tokens预扣费,余额须≥并发×$0.154否则403)+chat()撞模型上限自适应降档(M2.7上限196608实测)+细纲守卫60字绝对豁免+升格failed窗重跑先撤销+连续2窗失败才停书+模型输出str防御。compact时在跑(nohup脱离会话,勿重启):升格路(机动52+/80窗→深空116窗,日志/tmp/muse-b7-upgrade.log)+出卡双路(5书窗大纲续切→分型出卡,/tmp/muse-b7-cards[AB].log)+全局守护闸4700(/tmp/muse-b7-cards-main.log出STOP行=收尾)。跑完续跑序:check终检→review审核→export样张+升格样张(机动全书+深空末段压测数据)呈报创始人。固化脚本:parse_salvage.py(顽固章分段抢救)/parse_rewash.py(存量回洗)/parse_upgrade.py(作品面升格)。待创始人:样张过目、B3检索验证、B5确认门。
- 批3-5 分批拆(2026-07-14,创始人逐批给额度):批3(501次→322章)、批4(1000次→572章,529升5%)、批5 收尾(2000次自停零超支→1133章:星环250/机战510/超神373;M2.7救回281章,0硬停,529降至1.7%)。压缩+敏感降级实测有效。章级全局 5500/7345=75%:机动673✓/深空593(仅#143)/超神1438(差17)/星环1194/机战1602。待办:批6待创始人发额度(剩余约1845章≈2100次可全收口章级)、深空#143顽固敏感(备用模型疑也撞,单独攻)、机动/深空章级已完成可进窗大纲+出卡。续跑序:章级完→window切窗大纲→cards分型出卡→check终检→review审核→export样张。
- 参考书作品面数据入库(2026-07-14 创始人指令+同日认可开工):「这几本书本身也是被导入的作品,对应的数据也都需要入库」——方案 v6 定稿并已批准:
docs/2026-07-14-参考书作品面数据入库方案.md。四轮独立评审+创始人五条反馈换核,核心机制=全实体统一生长(废v4「前15全卡/轻卡」分层——创始人质疑成立):一实体一卡(唯一键=作品×型×归一名×范围,范围恒「本书私有」),每窗「机械预扫在场实体→实体观察→判重(留档/别名→嵌入近邻→AI终判)→卡更新(只对有新信息,批≤6张)→关系增量」,字段三类演进(底色覆写留审计/演进追加带窗号/当前态保最新);两阶段合并:拆书期候选卡就地累积,创作期走变更提案(draft表entity_id/proposed_changes/snapshot三列原生支持);正文窗直抽(3-5万字/窗,同窗调用连发吃缓存);防膨胀双设计(索引=窗内机械预扫命中集不随书涨/观察输出超12新名或15章对半分段)。5张升格工作表已建(db/ddl/94:别名/出场留档/窗状态/卡水位/覆写审计)。作品面抽取估3000-4800次,总额闸5000封顶,试跑校准;全链从2026-07-14起约5900-8400次。下一步:首书机动风暴~10窗+深空末段3窗压测出样张→创始人过目→放量。M3无思考确认(实测reasoning_tokens=0,中位out=331),维持不开(质量已达标,思考按输出计费烧次数,深推理单点用强模型)。 - 未决:①机动残留变体与感言章处理方式②跨书同功母卡归并=放量后公共面课题③S5 参数 A/B(M3 输出方差根治口)④S6 pacing 书级抽取(等整本拆完,依赖全本+作品面入库)。
- 教训入档:StructuredOutput 工具 schema 属性名仅限 ASCII(中文键 API 400)——schema ASCII 键+入库脚本键名归一;Tailscale 长事务需 keepalive+批量写(逐行两万往返曾半死 16 分钟)。
九·旧(2026-07-10 快照,留档)
- 执行主线=§七闭环序,知识域(A/B)先行;创作域(C)后置,待 B5 过门后按 C 线走。
- 拍板台账(①–④已全拍):①B2 首轮公共面只拆 5 型范式,双层型二轮凭脚手架实据定;细纲字数比例已拍入 outline schema。②已拍(2026-07-10)——参考书=
../小说清单/7 本全部导入私有库;首轮拆书 4 本:超神机械师/机战无限/深空之影/机动风暴(每本 30–50 章;原文只入私有库,公共面只有脱敏范式)。③已拍——主仓表原样不改列+私货全进example_*。④已拍——整序确认,A1 已起跑(B2 跑批前有成本确认闸)。 - 能力就位:skill 16 只(基建 7:read-context/confirm/eval 现有+db/import/embed/search 按 A2–B3 交付;功能 9 全建成,对齐官方规范)× agent 5(已瘦身为身份段);prompt 三段式(身份段×功能 skill×L0);上下文=四层+章级基线包共享前缀+按 agent 差异矩阵(read-context skill 为准);拆书=workflow 编排+逐章 agent 有界任务(parse-book skill 为准)。
- 基座:A1/A2 已收口(2026-07-13)——
muse-example库+pgvector 0.8.5 验通(容器重建恢复命令见连接信息),24 表建成(主仓一致 20 +example_*4,映射与暂缓登记见db/表映射.md),db skill 已交付;凭据与配方在db/连接信息.md;.venv丢失时按 requirements.txt 重建即用。 - 待审资产已清零(2026-07-10 创始人清理):文件版首轮的 13 张范式卡、参考书档案 extracted 态、《焚忆》全部文件资产已清除,工作区(干净 clone)无任何待审存量;首轮拆书的字段设计发现已蒸馏入
meta/schemas/(已提交),不受影响。 - 进度惯例:看 git log 与本节拍板台账,不设过程状态文档。