zizi d80df3ed7c 治理: 剩余问题收口——humanization 规则/样例数据库权威 + PG 集成全通过 + 行为评测脚手架 + raw 冲突备忘录
范围(不含 design-story-foundation、docs/design、docs/write-chapter、
craft/、humanization/README.md 等进行中改动):

1. humanization 规则/样例运行时数据库权威
   - db/ddl/111:example_ai_flavor_rule / example_ai_flavor_sample /
     example_ai_flavor_rule_event(append-only 生命周期留痕),已应用到 muse-example
   - deai/load_db.py:数据库装载器,激活门/重复检测/指纹与文件装载器同源;
     数据库失败关闭,不静默回退 Git 文件资产
   - humanization/tools/seed_rules_db.py:YAML 种子单事务同步,幂等、
     变化留痕、--strict 对 db-only 行失败关闭;真实库已种入 26 规则/107 样例
   - prevent/diagnose/revise 生产路径切到数据库读取(--offline 显式读文件),
     落库前新鲜度检查与合同声明来源一致;四个 SKILL.md 数据库合同同步
   - 真实库验证:规则库指纹与文件种子一致(v-609bc40e21d0b5db),
     三个生产脚本端到端从库装载通过

2. PostgreSQL 集成:显式授权后 9/9 通过
   - 此前被依赖门阻断的 6 个 _db/smoke 测试全部通过
   - extract rollback 冒烟改为回滚事务内自给夹具(pending 窗/草稿缺失时自建),
     不再依赖瞬时生产状态;夹具残留核验为 0

3. Skill 行为评测脚手架(真实执行数量仍为 0)
   - harness/evals/skill_eval.py:场景合同、六类评测范畴、适配器和结构化裁决报告
   - diagnose-ai-flavor 参考场景 4 条 + 管道自测 7 项通过
   - 真实模型适配器未授权时以稳定码 EVAL_ADAPTER_UNAVAILABLE 失败关闭;
     清单登记 skill_behavior_eval 条目,默认被依赖门阻断

4. evaluate-frozen-replay raw 存储边界冲突
   - docs/2026-08-19 备忘录:平台 DB-first 合同(创始人批准)与回放链
     仓外 vault 强制的冲突事实、两个选项和裁决前约束;运行时合同未单方面改写

5. harness 自身修复
   - runner 对账语义:行为评测入口不参与测试资产双向等值,但登记文件必须存在;
     manifest 保留 skill_behavior_eval 布尔字段并校验类型
   - 新增 2 条对账回归用例

验证证据: harness 三组自测 15+15+7 通过;静态审计 32 Skill / 0 问题;
76 个非数据库条目通过;9 个 PostgreSQL 集成条目显式授权后通过;
行为评测条目默认阻断;py_compile 与 git diff --check 通过。
未调用真实模型、embedding 或额度;真实行为评测执行数量仍为 0。
2026-08-19 02:41:25 +08:00

agent-example

agent-example 的目标是成为 Muse 的单用户缩小版,以 PostgreSQL 为正式内容权威:ReAct Agent 通过角色 Agent、Skill 和确定性工具,完成长篇小说的作品管理、实体维护、范式复用、规划、写作、审核、用户决策和经验复利。代码与文档在 Git,正式内容在数据库。

本项目不包含管理员、多用户、租户、市场、计费和资产交易。完整 Muse 产品、业务和总体架构仍以父仓 ../design-docs/ 为准。

数据权威

核心合同是:

PostgreSQL(muse-example 库) = 正式内容权威(作品 / 章 / 正文 / 实体 / 范式 / 用户决策 / 运行回执 / raw)
Git                           = 代码 / Skill / 文档 / DDL 的权威,并可对作品信息与作品文本留痕(历史 / 备份)
库内向量索引                   = 数据库一侧的检索加速,可从库重建

正式内容以库为准;Git 留痕不是权威,只读看板只读库,两者冲突时以库为准。可恢复性靠数据库备份,加上 Git 里的代码与 DDL 重建库结构。一切输入和产出都必须落库才能被看板看见。

三条正交轴

内容:作品 + 实体 + 范式
流程:上下文组装 -> 创作 -> 质量审核 -> 用户决策 -> 复利
能力:Agent + Skill + Tool + 数据库存储 + 只读看板

领域边界、数据权威和验收合同见 .agent/docs/architecture/domains/_index.md。该目录定义目标行为,不代表所有落库写入和只读看板已经完成实现。

当前工程入口

agent-example/
├── AGENTS.md                # 项目工作入口与规则
├── CLAUDE.md                # 只引用 AGENTS.md 的兼容入口
├── .agent/                  # 跨任务长期知识与领域设计 SoT
├── .claude/agents/          # 角色 Agent
├── .claude/skills/          # Skill、确定性工具和离线测试
├── meta/schemas/            # 结构本体与本地字段合同
├── meta/chains/             # 功能链、场景、用途和角色槽位
├── knowledge/               # 现有参考资产
├── db/                      # PostgreSQL(正式内容权威)的 DDL 与资料
└── docs/                    # 单次任务资料、评测样张和历史执行证据

正式内容在 PostgreSQL,不在 content/ 文件目录。判断有没有某个内容,以库里能不能查到为准;不得把库外文件或临时快照说成正式内容。

正向创作

用户意图
  -> 读取作品、实体和范式
  -> 冻结角色上下文
  -> 规划/写作 Agent 产生 Shadow 候选
  -> 确定性检查、语义检测和质量审核
  -> 用户原样接受、修改后合并或丢弃
  -> 正式正文(写入库内正文块)
  -> 实体草稿、范式观察和复利验证

Gate A/B 是开发期离线能力验收,不是正常用户写一章的生产主流程。评测候选固定不可进入 Canonical。

SoT 顺序

  1. 父仓 design-docs/:完整 Muse 产品、业务和总体架构。
  2. 本仓 .agent/docs/architecture/domains/:单用户、数据库为权威的领域边界。
  3. meta/:结构本体和功能链登记。
  4. .claude/agents/ 与 .claude/skills/:角色和可执行能力合同。
  5. docs/:单次任务过程、评测资料与执行证据,不覆盖稳定 SoT。

所有任务从 AGENTS.md 开始。

Description
No description provided
Readme 18 MiB
Languages
Python 72.7%
TypeScript 21.9%
PLpgSQL 4.8%
CSS 0.3%
Makefile 0.1%
Other 0.1%