范围(不含 design-story-foundation、docs/、humanization/README.md 等进行中改动):
1. 新增 harness/ 控制平面
- skill_harness.py 静态审计:32 个运行时 Skill 的 frontmatter/manifest/文档污染,当前 0 问题
- run_selected.py 选择性执行器:manifest 与磁盘一一对账、依赖阻断、
空跑与 skip-only 失败关闭、AST 测试形状门
- manifests/skills.json:32 个 Skill 的合同责任方与协作领域登记
- manifests/test-inventory.json:81 个测试资产登记
- specs/skill-testing.md 与 README.md:测试分层、证据边界与 harness 职责
2. 实现测试从 .claude/skills/*/scripts/ 迁至 tests/skills/<skill>/
- 71 个测试文件迁移并修复项目根与临时目录运行导入
- 数据库触发器测试宽泛异常收窄为 psycopg.errors.RaiseException
- 抽取离线大测试拆出真实 PG smoke(默认阻断,不计入离线通过)
- 抽取 presence 去重边界拆出独立测试:493 + 78 = 571 项检查不变
3. 运行时文档清理
- 13 个 SKILL.md 移除自测/离线验证段落、测试命令与测试文件事实源表述,
只保留运行时合同;业务运行合同、额度、授权与离线模式均保留
4. SoT 同步
- AGENTS.md:新增 Skill 领域索引(7 个合同责任方分组,覆盖 32 个运行时 Skill)
- 领域 07:测试入口改由 harness/manifests/ 登记,SKILL.md 不承载测试命令
- humanization 覆盖矩阵:活动测试路径同步迁移
验证证据: harness 自测 15 项 + runner 自测 13 项通过;静态审计 32 Skill / 0 问题;
73 个非数据库测试通过;8 个集成条目中 6 个 PostgreSQL 项被依赖门明确阻断;
py_compile 与 git diff --check 通过。未连接 PostgreSQL、网络、真实模型或额度。
已知边界: 真正 skill_behavior_eval 仍为 0,尚未验证任何 Skill 自然语言行为;
evaluate-frozen-replay 的 raw 存储边界冲突留待单独治理。
77 lines
2.7 KiB
Python
77 lines
2.7 KiB
Python
#!/usr/bin/env python3
|
||
"""范式规划期绑定读取回归:load_confirmed_pattern_bindings(桩连接,不连真库)。
|
||
|
||
实验仓承载:绑定 = 最新一条已确认 assembly 规划行的 patternReferences。
|
||
确认 assembly 即激活绑定;无已确认 assembly 或没选范式时诚实返空(不报错)。
|
||
"""
|
||
|
||
import pathlib
|
||
import sys
|
||
import unittest
|
||
|
||
PROJECT_ROOT = pathlib.Path(__file__).resolve().parents[3]
|
||
SCRIPT_DIR = PROJECT_ROOT / ".claude" / "skills" / "assemble-context" / "scripts"
|
||
sys.path.insert(0, str(SCRIPT_DIR))
|
||
|
||
from retrieve_writer_sources import load_confirmed_pattern_bindings # noqa: E402
|
||
|
||
|
||
class FakeCursor:
|
||
def __init__(self, row):
|
||
self._row = row
|
||
|
||
def fetchone(self):
|
||
return self._row
|
||
|
||
|
||
class FakeConn:
|
||
def __init__(self, row):
|
||
self._row = row
|
||
self.sql = None
|
||
self.params = None
|
||
|
||
def execute(self, sql, params=None):
|
||
self.sql = sql
|
||
self.params = params
|
||
return FakeCursor(self._row)
|
||
|
||
|
||
def assembly_payload(refs):
|
||
return {"schemaVersion": "assembly-v1", "workId": 12,
|
||
"patternReferences": refs, "knowledgeBindings": []}
|
||
|
||
|
||
class PatternBindingReaderTest(unittest.TestCase):
|
||
def test_returns_confirmed_assembly_pattern_references(self):
|
||
refs = [{"sourceId": "card:1", "sourceVersion": "v1", "name": "锁空坠杀"},
|
||
{"sourceId": "card:2", "sourceVersion": "v1", "name": "碎颅"}]
|
||
conn = FakeConn((assembly_payload(refs),))
|
||
result = load_confirmed_pattern_bindings(conn, work_id=12)
|
||
self.assertEqual(result, refs)
|
||
self.assertIn("section_type='assembly'", conn.sql)
|
||
self.assertIn("state='confirmed'", conn.sql)
|
||
self.assertIn("ORDER BY version DESC LIMIT 1", conn.sql)
|
||
self.assertEqual(conn.params, (12,))
|
||
|
||
def test_no_confirmed_assembly_returns_empty(self):
|
||
conn = FakeConn(None)
|
||
self.assertEqual(load_confirmed_pattern_bindings(conn, work_id=12), [])
|
||
|
||
def test_jsonb_as_string_is_parsed(self):
|
||
conn = FakeConn(('{"patternReferences": [{"sourceId": "card:9", "name": "x"}]}',))
|
||
result = load_confirmed_pattern_bindings(conn, work_id=12)
|
||
self.assertEqual(result, [{"sourceId": "card:9", "name": "x"}])
|
||
|
||
def test_empty_selection_returns_empty(self):
|
||
conn = FakeConn((assembly_payload([]),))
|
||
self.assertEqual(load_confirmed_pattern_bindings(conn, work_id=12), [])
|
||
|
||
def test_non_dict_references_are_filtered(self):
|
||
conn = FakeConn((assembly_payload([{"sourceId": "card:1"}, "bad", 42, None]),))
|
||
self.assertEqual(load_confirmed_pattern_bindings(conn, work_id=12),
|
||
[{"sourceId": "card:1"}])
|
||
|
||
|
||
if __name__ == "__main__":
|
||
unittest.main()
|