28 KiB
muse-agent-example —— muse 的创作实验台
- 版本:v3(2026-07-09,路线定版:文件创作台先行,真后端第二步;不再模拟数据库与知识库引擎)
- 仓库:独立 git,remote
ssh://git@101.200.34.71:2222/zizi-al/muse-agent-example.git;本地物理上住在 oh-my-muse/ 下(父仓已 ignore),为的是就近引用 design-docs - 概念权威:一律以
../design-docs/(专题-06、架构-02)为准;这里发现设计不合用,回填那边,不在本仓自立定义
一、定位:不是迷你 muse
Claude Code 在这里只扮演一个角色:智能体运行时——真架构里这个位置本来就是可替换的外部运行时(专题-05 定义的那道缝)。它真写一部小说,验证面就是可读的作品内容。给 muse 沉淀四样东西:
- agent 能力:写作/规划/抽取/检测的 prompt 按天迭代,达标版即未来 muse 智能体配置的种子;
- 元数据设计的实战修订:23 型 schema 在真实创作里用,字段缺什么、哪里别扭,写两章就暴露,改完回填 design-docs 与 W1 种子;
- 知识卡内容设计:知识库不模拟引擎(向量检索已在真环境证成),只打磨内容那一半——卡长什么样、检索回来怎么进上下文;
- (阶段二)真实 API 的使用反馈:哪只缺、哪只难用,即交付物。
二、两阶段
- 阶段一(现在):纯文件 + git,无库无服务。产出可读的小说、schema 修订、达标 prompt。
- 阶段二(创作流稳定后):同一套创作流换接真后端
/app-api(单人版 compose 按主仓 S9 收口已验证可从零起)。真 PG 在 infra、建表即主仓迁移 SQL、全用系统主账号调用——「要真表真 SQL」的要求由真后端天然满足,不拷库。
三、数据规则(三条)
- 人逐行读改的进文件:正文一章一个 md;每作品四个小文件(
设定.md、大纲.md、状态.md、装配.yaml)加一个带索引的知识卡目录。不按段落/场景拆文件。 - 运行噪音进
works/*/评审/:检测报告、评分、上下文包回显都在这,.gitignore 挡住——可看、可复跑、不入历史。 - 待审与确认交给 git:智能体产出一律不提交,
git diff就是候选评审界面;确认 = commit(提交信息带来源),丢弃 = restore;git log天然是采纳台账。
四、目录与能力清单
agent-example/
├── CLAUDE.md ← 会话章程:主会话只编排裁决;确认只能由用户触发
├── .claude/
│ ├── agents/ ← 动脑的:writer / planner / extractor / detector / judge
│ └── skills/ ← 基建 skill(组装/确认/收敛+库/导入/嵌入/检索) + 功能 skill(每 scenario 一只功能合同)
├── meta/schemas/ ← 23 型结构本体设计稿(对齐专题-06;README 有实例落点表)
├── meta/chains/ ← 功能链与功能指令设计稿(prompt 三段式的功能段;G2 治理对象)
├── knowledge/ ← 跨作品层:参考书原文 + 拆书产出的公共范式卡(绑定才进上下文)
└── works/<书名>/
├── 设定.md ← 作品容器+作品核心+世界观总纲+文风画像(四节一文件)
├── 大纲.md 状态.md 装配.yaml
├── manuscript/ ← 正文,一章一个 md,frontmatter 按 chapter/scene 合同
├── 知识/ ← 本作品知识卡:人物/地点/势力/功法体系/物品/事件/关系 + 索引.md
└── 评审/ ← 运行噪音(gitignored)
能力清单(公约:所有 API/工具能力一律封装为 skill,不散写一次性脚本、不裸调外部服务)
skill 两族共 16 只:基建 7(确定性工具能力,每只=未来 muse API 的一道缝;现有 3 + 按闭环步交付 4)+ 功能 9(每 scenario 一只,承载功能细节约束=功能链场景合同,已全部建成)。
| skill | 做什么 | 对应 muse API 面 | 状态 |
|---|---|---|---|
| read-context | 统一读取器:读装配绑定→按用途+aiContext 三级裁剪→组装六分区上下文包→裁剪清单回显 | 统一创作数据读取器(专题-06 §7) | 现有(文件版);C4 升 PG 检索版(内部调 search) |
| confirm | 唯一确认通道:确认=commit、丢弃=restore,仅创始人触发;PG 版加知识行草稿→已确认翻转 | 双轨提交 / 候选三决策入口 | 现有 |
| eval | 质量收敛环:n=5、每轮只动一个变量、达标固化 golden/ |
质量域 | 现有 |
| db | muse-example 唯一数据库通道:psycopg 直连封装(凭据按 db/连接信息.md),查询/DDL/DML/SQL 文件应用全走这,结果卡片式打印(=审查面) |
数据访问层 | 已交付(2026-07-13) |
| import | 导入解析:txt→回目正则静态分章→作品/章行入库(调 db) | 导入解析旅程 | B1 交付;C8 用户旧稿复用 |
| embed | New-API 嵌入封装:Qwen3-Embedding-8B、dimensions:1024、--noproxy、批量+失败重试 |
AI 网关(嵌入) | B2 交付 |
| search | 向量检索:意图→embed→pgvector 相似度召回→授权过滤(仅已确认+已绑定)+字段裁剪→带相似度分的结果集 | 知识检索 | B3 交付 |
功能 skill ×9(prompt 三段式的功能段;每只必带「元数据驱动」节写明 schema 怎么控制它;链登记表见 meta/chains/README.md):
| 功能 skill | 一句话 |
|---|---|
| continuation / rewrite / expansion / polish | 写作四功能:章结构=chapter/scene 字段合同;改写锁范围+版本核对;扩写只扩内容不加设定;润色只动表达层+逐处清单 |
| planning | 产出结构=schema 字段清单本身;字段全覆盖或标「字段存疑」 |
| parse-book / extract-knowledge | 拆书(判据归型+脱敏红线+设计发现回写)与章后抽取(字段合同=抽取 checklist;冲突不覆盖) |
| detect | 检查清单由 aiContext 含 detection 的字段自动生成,schema 加字段检查项+1 |
| quality-gate | 专题-04 维度体系的单一来源(3 叙事关键定达标线+5 非关键出建议) |
skill 官方规范对齐(2026-07-09 按 code.claude.com/docs 核查):frontmatter name(≤64,小写连字符)+description(≤1024,第三人称,写清做什么+何时用);正文纯 markdown <500 行,附属文件(scripts/reference)从 SKILL.md 单层链接;progressive disclosure 三级(description 常驻 / 正文按调用加载 / 附属按需)。功能 skill 递送给子代理:官方三机制——子代理带 Skill 工具自主调用、frontmatter skills: 启动预加载、skill 侧 context: fork 反向驱动;但 skills: 预加载是"列出的全部注入",与「一次只带本次功能」冲突——定为主会话内联:派发时读 SKILL.md 正文按拼装序塞进功能指令段位,子代理无需 Skill 工具(tools 受限不影响,我们的功能 skill 是纯 markdown 合同、无动态注入语法,内联零损失)。9 只功能 skill 已标 disable-model-invocation: true(防主会话误自动触发、description 不占常驻上下文,/name 手动仍可用)。
skill 形态公约:每只 skill = SKILL.md(何时用+输入输出合同)+ scripts/*.py(封装好的确定性实现)。Python 3.12 + uv 管理的 .venv,依赖清单 requirements.txt(psycopg[binary] / requests / pyyaml / click),多用通用依赖不造轮子;PG 经 psycopg 直连(连通事实与凭据见 db/连接信息.md),New-API 调用禁系统代理(trust_env=False);脚本失败原样报错不静默。现有三只流程型 skill(read-context/confirm/eval)以流程管控为主,涉库涉外步骤在 PG 版升级时同样下沉进脚本。
agent = 动脑的(LLM 判断力,达标 prompt 即未来 agent_version.config 种子)——共 5 个,全 opus,与 专题-06 §3 智能体三层清单 一一对应、无自造型:第一层开放槽位件 4 + 第二层保护节点件 1。
| agent | SoT 身份(专题-06 §3 / 专题-03 §2.3) | 做什么 | 用在 |
|---|---|---|---|
| writer | 一层 · 写作(Writing 槽位) | 整章正文候选:2500–3500 字、AI 味黑名单零命中、新设定申报注释块;只进待审 | C4 |
| planner | 一层 · 规划(规划链槽位) | 设定包/大纲/细纲候选;字段全覆盖或标「字段存疑」;未确认不进后续生成上下文 | C2 |
| extractor | 一层 · 拆书/分析(Analysis 槽位) | 两用场:拆书(B2,按库内 schema 产知识行草稿+出处链;系统级只产抽象范式、不留原文)与章后抽取(C5);冲突标「⚠ 冲突待裁决」不覆盖 | B2 / C5 |
| detector | 一层 · 检测(Detection 槽位) | 一致性/伏笔/设定违背检查,只产解释与定位落 评审/,不改正文与知识 |
C4 伴随 |
| judge | 二层 · 保护节点(质量门控与 LLM-Judge)——不可被装配替换,即 G2 判据的活体 | 按专题-04 §4 维度体系评分:3 叙事关键(定达标线,全部 ≥4.0 过门)+5 非关键(只出建议),引文证据制 | C6 / eval 内 |
SoT 第三层「知识基座」(检索/切块/入库,明文不是 app)在实验里即 skill 层(db/import/embed/search)——正好印证「所有 API/工具皆 skill」。分工判据:需要 LLM 判断的进 agent;确定性的取数、写库、外部调用、流程管控进 skill;LLM 参与但属主权裁决的落保护节点(不开放装配)。agent 只经 skill 拿上下文与落库。
prompt 三段式(登记表见 meta/chains/README.md):身份段(agent .md,跨功能共享)× 功能指令段(功能 skill,每 scenario 一只,派发只加载本次一只)× L0 任务特化——不做一个 agent 一个大 prompt(防指令稀释),也不按功能裂 agent(防身份复制)。skill 辅助映射:extractor 最重(db 读 schema 与既有知识、产出经 db 写入 draft、embed 嵌入);writer/planner/detector 经 read-context 取数、PG 版加 search 召回;judge 零外部依赖(基线包+rubric);import 是纯确定性工具,LLM 不参与。
LLM 能力功能全覆盖对照(SoT 功能 → 实验落点,防漏配):写作 7 功能(续写/改写/扩写/润色/纠错/去AI味/角色声音)→writer;规划 5 动作(生成/补全/整理/检查/多方案,产品-03 §3.5)→planner;分析 6 功能(目标分析/实体解析/候选草稿提取/全书解析/章节抽取/结构拆解)→extractor;检测 5 检查(风险/一致性/角色声音/文风/语义偏离)→detector;质量评分 8 维(专题-04:3 叙事关键+5 非关键)→judge;有限重写(≤2 次,专题-04 §5)→eval 环承担(judge 诊断+writer 重生成,人在环);合规与语义围栏→不镜像(阶段一由平台安全层承担,阶段二真后端承接);组装内摘要化(超预算先摘要低层)→read-context 流程内动作;嵌入/重排→embed/search skill(第三层模型能力,非 agent);硬阻断 3 维(来源安全/输出合规/静态结构)→规则层检查,skill/流程承担,不进评委职权。
上下文组装结构(SoT=专题-03 §4 四层上下文 + 专题-06 §7 统一读取器;操作细节以 read-context skill 为准)
四层上下文(专题-03 §4.2;请求带 scenario 用途与授权语义)
├── Layer 0 当前输入 任务目标+本章细纲+当前文本 ——不可省略
├── Layer 1 近邻正文 上一章末尾场景原文+再前一章摘要+近期叙事状态 ——续写不可省略
├── Layer 2 作品事实 设定四节+正式规划+状态台账+知识卡(仅出场+关联) ——只读已确认(Canonical)
└── Layer 3 授权资料 绑定的公共范式库/全局知识 ——按场景可省;必须有绑定授权
预算顺序:先留输出预算 → L0 完整保留 → L1 优先 L2 优先 L3;超限先摘要化低层再截断
拼装顺序(物理序,与预算序是两回事,按稳定度递减):
通用系统位(全 agent 相同) → 章级基线包(L2+L1+L0稳,按 writer 视图组装,跨 agent 共享缓存)
→ agent 身份段(角色指令后置) → 功能指令段(本次 scenario 的功能 skill)
→ agent 增量段(底牌/全集/rubric/L3 检索结果,只加不减) → L0易变部(用户本回合意图,绝对尾置)
——同章流水线 writer 首跑写缓存,后续 agent 按 1/10 价读;基线=writer 视图锁"无人多看",
增量只加锁"无人少看";阶段一子代理机制钉系统位不落此布局,阶段二 Context Assembly 落
裁剪回显(落 评审/,验收证据):字段级=aiContext 裁剪清单(专题-06 §7)
+ 来源级=omittedSources(原因枚举:token_budget/not_authorized/stale_source/low_confidence/not_relevant/blocked)
文件版落位:设定/大纲/状态/知识卡→L2,正文近邻→L1,装配绑定的公共范式→L3,派发指令与细纲→L0。三级裁剪=字段级 aiContext / 来源级 装配绑定 / 用途级 scenario。PG 版只改 L2/L3 取数方式(search 召回+授权过滤),层结构与回显合同不变。
按 agent 差异(骨架不变,差异=字段可见集×每层取数范围×层必省性;完整矩阵在 read-context skill):writer 防剧透(底牌全闭、仅出场卡);planner 看全局(唯一底牌全开+未来粗纲);extractor 忠于原文(待拆章全文是处理对象、L3 关闭防诱导脑补);detector 持有基准(知识全集+底牌开,专查提前泄底);judge 同证独立(可见面=writer 基线不多不少、L3 关闭防拿范式放水)。矩阵为实验设计稿,验证后回填专题-03 §4。
五、一次续写怎么走
- 主会话读
装配.yaml(写作槽位绑了哪个写手、绑定了哪些公共库); - 走
read-context组装上下文:设定与知识卡按 schema 的aiContext裁剪(如「结局方向」续写时不给)、近两章正文尾部、状态.md、本章细纲;被裁掉的字段记入回显,落评审/; - 写手产出整章,直接写进
manuscript/新章文件——不提交; - 检测/评委只读产出报告与评分,落
评审/; - 你读章 + 看报告:满意 → 走
confirmcommit;要改 → 提意见重生成;不要 → restore; - 确认后抽取员按 schema 从新章抽新实体/事件 → 知识卡(状态:草稿)落
知识/,与既有卡冲突时标冲突留你裁决;下次续写即可被读取器用上。
「角色卡长什么样」由 schema 声明——加一个字段,抽取与生成的产出立刻多这个字段,智能体一行不改;换绑写手只改 装配.yaml。这两条是「元数据驱动」的活体证明(场景 A7 专门验收)。
六、schema 设计稿公约
- 型名、两轴(domain×scope)、判据与专题-06 §4 严格对齐;字段是本仓先行草拟的实战设计稿(SoT 尚未给出逐型字段合同的部分由这里试出来)。
- 实战中的字段增删、判据修正 → 回填 design-docs 与 W1 种子后,在 schema 文件里标注「已回填@日期」。本仓不是字段定义的长期 SoT。
- 作品级扩展走
装配.yaml的「作品级扩展字段」,只增不改(对齐 base/override 机制)。
七、产品场景台账(对齐 产品-03,实验按真实产品旅程推进)
实验不走自造场景序,按 muse 的产品旅程走:管理员治理旅程(产品-03 §4)先备能力与全局资产,普通用户旅程(§2.2/§3 no-config 主线 + 增强路径)走创作闭环。市场、计费、个人中心不镜像,阶段二真后端承接。
管理线(管理员控制台旅程)
| # | 产品场景(SoT 锚) | 实验落法 | 判据锚 |
|---|---|---|---|
| G1 | 元结构治理:base schema 发布(§4.2) | meta/schemas/ 23 型种子与字段合同,发布=框架 commit |
字段全覆盖;发现回写「设计发现」 |
| G2 | 系统能力治理:功能链/槽位/默认件(§4.3) | 四槽位默认智能体 + read-context 保护流程 + confirm 封闭入口 | 保护节点不可被装配替换 |
| G3 | 全局知识治理:系统级拆书→授权(§4.4) | 参考书导入→拆书范式卡(草稿)→管理员确认(=commit)→作品侧凭绑定使用 | 范式卡脱敏带出处;未确认不授权 |
用户线(no-config 主路径 + 增强路径)
| # | 产品场景(SoT 锚) | 实验落法 | 判据锚 |
|---|---|---|---|
| U1 | 我的作品:新建作品(§3.2) | works/<书>/ 容器就位 |
容器合 novel_work 合同;确认随 U2 一并 commit |
| U2 | 规划旅程:候选→用户确认→正式规划(§3.5) | 设定包+大纲候选(未提交)→ 用户确认 | 未确认规划不进生成上下文 |
| U3 | AI 候选旅程:三决策(§3.4) | 续写候选 + 上下文回显 → 原样接受 / 修改后合并 / 丢弃 | 回显含裁剪清单;决策前 Canonical 零变化 |
| U4 | 知识确认旅程(§3.6) | 采纳后抽取→草稿→自动确认(自有正文+无冲突)/ 冲突入待确认队列 | 采纳正文≠确认知识;冲突必人工 |
| U5 | 增强·知识库绑定(§6.3) | 装配.yaml 绑 knowledge/范式/,用户确认生效 |
绑定≠写入;解绑即从上下文消失 |
| U6 | 增强·槽位替换(§5.3) | 换绑写手件,证「元数据驱动」 | 链与流程零改动,产出风格切换 |
| U7 | 导入解析旅程(§3.7) | 导入旧稿→解析分章→逐章审阅确认→知识草稿 | 解析结果先入待审;确认按章 |
| U8 | 导出交付(§3.8) | 编译全书正文+设定导出 | 导出走确认后内容,含来源标注 |
| — | 质量收敛(伴随 U3 循环,专题-04 简化) | judge 按专题-04 维度评分 + eval n=5 收敛,达标固化 golden/ |
评分有引文证据;叙事关键三维 ≥4.0 达标 |
产品红线原样生效:候选决策只有三类(原样接受/修改后合并/丢弃);采纳正文≠确认知识;未确认规划不进生成上下文;绑定≠写入;保护节点不可替换(§1.1-12)。
完整闭环执行序(对齐稿 v2,2026-07-09,待创始人拍板)
创始人已拍:知识域先行(PG+向量插件为基座、以可见知识库数据为审查)、创作域后置。完整闭环 = 四阶段三回路:作品内环(生成→章后抽取→知识回库→供下一章)、元数据环(拆书/创作暴露的字段问题→修订 schema 种子→产出立刻变)、设计环(发现回填 design-docs 与 W1 种子)。
flowchart LR
A[A 基座与元结构<br>建库·表映射·schema种子入库] --> B[B 全局知识生产<br>导入分章→拆书→检索→优化环]
B --> G{B5 管理员确认+授权门}
G --> C[C 创作域<br>建作→规划→绑定→续写三决策→导出]
C -->|章后抽取→知识确认→回库| C
B & C -->|字段/判据修订| A
B & C -->|设计发现| D[D 回填design-docs<br>+阶段二换接真后端]
阶段A 基座与元结构(管理线 G1/G2)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| A1(原K0) | 基座 | muse-example 建库+vector 插件;嵌入通道已实测(Qwen3-8B 默认 4096、dimensions:1024 生效) |
psql 实测输出 | 未做,第一步 |
| A2(原K1) | 库表映射 | 主仓 sql/muse 摘录一致 DDL(meta / work·chapter / knowledge 三域)→应用;实验私货全进 example_* 前缀(嵌入边表 vector(1024)、tenant/creator 默认系统主账号=1);交付 db 查询 skill |
\dt + 表↔主仓迁移来源映射 |
未做 |
| A3(原K2) | G1 元结构治理 | 23 型 YAML → meta 表行(=W1 种子演练);此后拆书/抽取一律读库内 schema | schema/字段行卡片打印 | ✅ 已收口(2026-07-13):23 型/294 字段行,字段级 aiContext 入 policy_snapshot;seed_schemas.py 幂等 |
| A4 | G2 系统能力治理 | 四槽位默认智能体(身份段)+ 功能 skill ×9 + 功能链登记表(meta/chains/)+ read-context/confirm/eval 保护流程 |
保护节点不可被装配替换 | 已就位(文件侧);装配入库随阶段二 |
阶段B 全局知识生产(管理线 G3 主体;审查=可见知识库数据)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| B1(原K3) | 参考书导入+静态分章 | import 工具(回目正则)→ 8 本全本作品/章/块入库 | 作品/章行数对账+quality_report 基础面报告 | ✅ 基本收口(2026-07-13):8 本 ≈1.18 万章全入库;机战无限/超神机械师因源损坏格式(区间章号/分页尾巴/残破实体)用修复后解析器重导 |
| B2(原K4) | 拆书智能体 PG 版 | extractor 走 parse-book 2b:先逐章逆推细纲+抽实体作脚手架,再在其上按库内 schema 拆范式→知识行(draft)+嵌入 | 脚手架(细纲/实体)+知识行卡片打印+分型统计+出处链 | 文件版首轮流程已验(产物已清理,字段发现存 schema);PG 版从零起拆 |
| B3(原K5) | 检索验证 | 创作意图→相似度召回;授权与 aiContext 裁剪落查询层 | 检索结果+相关性人工评 | 未做 |
| B4(原K6) | 联合优化环 | prompt × schema 字段 × 知识行质量,n=5 收敛 | 迭代前后对比+设计发现清单 | 未做 |
| B5 | G3 确认+授权门 | 管理员确认(状态草稿→已确认,=commit)→开放作品侧绑定 | 已确认行清单/授权台账 | 无存量,待 B2 产出 |
阶段C 创作域(用户线 no-config 主线+增强;创始人已拍后置,B5 过门后启动)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| C1 | U1 新建作品 | 作品实体入库(新作) | 作品行合 novel_work 合同 | 未做 |
| C2 | U2 规划确认 | 设定包+大纲候选→用户确认→正式规划 | 未确认规划不进生成上下文 | 未做 |
| C3 | U5 绑定全局库 | 装配绑定已确认范式库,确认生效 | 绑定行;解绑即从上下文消失 | 未做 |
| C4 | U3 续写三决策 | read-context 升 PG 检索版→候选→原样接受/修改后合并/丢弃 | 回显含裁剪清单;决策前 Canonical 零变化 | 未做(文件版流程已演练,产物已清理) |
| C5 | U4 知识确认旅程 | 章后抽取→草稿→自动确认(自有正文+无冲突)/冲突入待确认队列;新知识回库供下一章=作品内环闭合 | 采纳正文≠确认知识;冲突必人工 | 未做 |
| C6 | 质量收敛(伴随 C4) | judge 按专题-04 维度+eval n=5,达标固化 golden/ |
引文证据;叙事关键三维 ≥4.0 达标 | 未做 |
| C7 | U6 槽位替换 | 换绑写手件,链与流程零改动 | 产出风格切换=元数据驱动活证 | 未做 |
| C8 | U7 用户导入解析 | 用户旧稿导入(复用 B1 工具)→逐章审阅确认→知识草稿 | 解析先入待审;确认按章 | 未做 |
| C9 | U8 导出交付 | 编译全书正文+设定导出 | 只含确认后内容,带来源标注 | 未做 |
阶段D 回填与换接(伴随各阶段,期末收口审计)
| # | 场景锚 | 步骤 | 审查面 | 现状 |
|---|---|---|---|---|
| D1 | 设计环收口 | 设计发现回填 design-docs(专题-06/后端-04/W1 种子),本仓 schema 标「已回填@日期」 | 回填 commit 清单+两侧对读 | 9 条发现已归档在 schema 文件,未回填 |
| D2 | 阶段二换接 | 同一创作流换接真后端 /app-api;沉淀 API 缺口清单 |
缺口清单 | 未启动 |
待拍板(①已拍):① 已拍 A@2026-07-09——B2 首轮公共面只拆 5 型范式,双层型(人物原型等)待脚手架数据可见后二轮决策;② 封神演义导入与拆书范围(决策中);③ A2 口径=主仓表原样不改列、私货全进 example_*;④ 本闭环序整体确认——确认即从 A1 起跑,B5 前每阶段收口报一行。
八、给 muse 的产出物清单
达标 prompt(→ 未来 agent_version.config 种子);schema 修订(→ 专题-06/后端-04/W1 种子);知识卡样式与上下文组装打法(→ 统一读取器 API 设计参考);golden/ 样张与质量基线(→ 完整工程同场景对拍);阶段二的 API 缺口清单。
九、当前位置(2026-07-13 快照)
执行态速览(compact 后从此恢复;细节看 git log 与库内状态表)
- A 阶段全收口:muse-example 库+pgvector 0.8.5(容器重建恢复命令见
db/连接信息.md);24 表(主仓一致 20+example_* 5,含 92-清洗日志表;映射见db/表映射.md);23 型 schema 入库(294 字段行,字段级 aiContext 在 visibility_policy.policy_snapshot)。 - B1 基本收口:8 本参考书全本入库(希泊尼战纪1496 / 星环使命1722 / 机动风暴673 / 机武风暴686 / 机破星河2250 / 深空之影594 / 超神机械师 / 机战无限2901 章;星环使命为创始人 2026-07-13 新增)。源损坏修复经历:双章区间号「第2373-2374章」、分页尾巴「(第1/1页)」、残破实体「&bp;」、纯中文数字章题+重贴+目录页(机动风暴)——全部进 import 解析器规则。基础面验收工具=
quality_report.py(字数/分章/章题/段落/垃圾嫌疑扫描)。 - 书单拍板(2026-07-13 创始人):先试拆几本书前几章给创始人质检(试拆流水线=workflow 编排+逐章两 pass:scaffold(opus)→ingest(haiku)→patterns(opus)→ingest(haiku);脚本存 session workflows/,状态在 example_parse_task/scaffold/draft 表),质检过再放量。
- 清洗方案拍板(2026-07-13 创始人):语义垃圾走「LLM 探测输出待删段原文+代码精确匹配删除」=clean skill(窗口≈10万字/次调用,守卫规则+审计表 example_clean_log;机破星河最脏 879 求票+306 PS,win 文件已备 /tmp/muse-clean/7/)。
- 在飞任务(compact 时):超神机械师重导(修其 14 个百字以下章);试拆 workflow(机动风暴 1–3 章,ch1 脚手架已过校验:细纲 5.0%/实体 6)。
- 未决:①试拆结果质检(含范式卡样张)②清洗范围拍板(仅拆书范围 ≈12 次 haiku vs 全语料 ≈350 次)③B2 放量确认闸(编排+成本呈报后创始人拍)。
- 教训入档:StructuredOutput 工具 schema 属性名仅限 ASCII(中文键 API 400)——schema ASCII 键+入库脚本键名归一;Tailscale 长事务需 keepalive+批量写(逐行两万往返曾半死 16 分钟)。
九·旧(2026-07-10 快照,留档)
- 执行主线=§七闭环序,知识域(A/B)先行;创作域(C)后置,待 B5 过门后按 C 线走。
- 拍板台账(①–④已全拍):①B2 首轮公共面只拆 5 型范式,双层型二轮凭脚手架实据定;细纲字数比例已拍入 outline schema。②已拍(2026-07-10)——参考书=
../小说清单/7 本全部导入私有库;首轮拆书 4 本:超神机械师/机战无限/深空之影/机动风暴(每本 30–50 章;原文只入私有库,公共面只有脱敏范式)。③已拍——主仓表原样不改列+私货全进example_*。④已拍——整序确认,A1 已起跑(B2 跑批前有成本确认闸)。 - 能力就位:skill 16 只(基建 7:read-context/confirm/eval 现有+db/import/embed/search 按 A2–B3 交付;功能 9 全建成,对齐官方规范)× agent 5(已瘦身为身份段);prompt 三段式(身份段×功能 skill×L0);上下文=四层+章级基线包共享前缀+按 agent 差异矩阵(read-context skill 为准);拆书=workflow 编排+逐章 agent 有界任务(parse-book skill 为准)。
- 基座:A1/A2 已收口(2026-07-13)——
muse-example库+pgvector 0.8.5 验通(容器重建恢复命令见连接信息),24 表建成(主仓一致 20 +example_*4,映射与暂缓登记见db/表映射.md),db skill 已交付;凭据与配方在db/连接信息.md;.venv丢失时按 requirements.txt 重建即用。 - 待审资产已清零(2026-07-10 创始人清理):文件版首轮的 13 张范式卡、参考书档案 extracted 态、《焚忆》全部文件资产已清除,工作区(干净 clone)无任何待审存量;首轮拆书的字段设计发现已蒸馏入
meta/schemas/(已提交),不受影响。 - 进度惯例:看 git log 与本节拍板台账,不设过程状态文档。