一、技能重组(动作-对象命名) - 旧目录 clean/confirm/continuation/db/detect/embed/… 重组为 clean-book-text/decide-candidate/write-next-chapter/access-database/ check-content-consistency/embed-knowledge/…(git 识别为 rename,内容保持) - agents/*.md、AGENTS.md/CLAUDE.md 收编、example_skill 登记表同步新名 二、先审后入创作闭环(本次核心) 正文接受从"机械门一过就写正典"改为"机械门+语义审查双通过+用户批准+单事务原子提交", DB 级兜底,编排层跳步即被硬拒。 - candidate_cas.py + example_candidate_cas(109):持久化 CAS 状态链 - fact_delta.py + example_fact_delta/example_fact_ledger(106):结构化事实增量, 模型只提六型闭集增量+正文证据引文,仅用户批准的增量随正文同事务入账本 - projection_registry.py + example_projection_run(107):投影登记与恢复 - acceptance_state.py:接受前置实时状态重读 - lesson_registry.py + example_lesson(108):经验升格链,禁止自动升格 - DDL 105:example_candidate 增 semantic_status/semantic_report_sha256 - write_canonical.accept:语义兜底+同事务合并增量+登记投影; run_writer_pipeline/persist_writer_run/run_writer_semantic_detector/step2 接入全链 - claude_runtime:兼容新 CLI modelUsage 信息字段 三、审查修复(独立子代理四维审查后) - 事实增量 propose→approve 翻态正道,不撞唯一键 - 冻结配置探针重刷(CLI 2.1.211→2.1.231 漂移),profileSha256/adapterVersion 再登记 - 可视化合同悬空路径/五六空间矛盾、 SoT 旧技能名漂移、行尾空白清理 测试:离线 65 套 + 真实库集成 5 套(CAS/接受故障注入/事实增量/投影/经验升格)+ 回放 79 项全绿。 创作内容(docs/design、生成正文 artifacts)按"框架与创作分开"未入本提交。
140 lines
4.0 KiB
Python
140 lines
4.0 KiB
Python
#!/usr/bin/env python3
|
|
"""模型调用持久化合同的离线测试。
|
|
|
|
这些测试不连网、不连库,只固定共享 LLM 入口必须向持久化适配器提供的证据形状。
|
|
"""
|
|
import json
|
|
import pathlib
|
|
import sys
|
|
import types
|
|
|
|
|
|
sys.path.insert(0, str(pathlib.Path(__file__).resolve().parent))
|
|
import llm # noqa: E402
|
|
|
|
|
|
USAGE = {
|
|
"prompt_tokens": 12,
|
|
"completion_tokens": 7,
|
|
"prompt_tokens_details": {"cached_tokens": 3},
|
|
}
|
|
|
|
|
|
class FakeResponse:
|
|
status_code = 200
|
|
text = ""
|
|
|
|
def raise_for_status(self):
|
|
return None
|
|
|
|
def json(self):
|
|
return {
|
|
"choices": [{
|
|
"message": {"content": "模型输出"},
|
|
"finish_reason": "stop",
|
|
}],
|
|
"usage": USAGE,
|
|
"id": "completion-1",
|
|
}
|
|
|
|
|
|
def test_chat_emits_a_complete_persistence_event():
|
|
"""成功调用应把完整请求/响应和审计字段交给原子落库适配器。"""
|
|
events = []
|
|
|
|
class FakeSession:
|
|
trust_env = True
|
|
|
|
def post(self, url, headers=None, json=None, timeout=None):
|
|
return FakeResponse()
|
|
|
|
old_session, old_time = llm.requests.Session, llm.time
|
|
try:
|
|
llm.requests.Session = FakeSession
|
|
llm.time = types.SimpleNamespace(time=lambda: 100.0, sleep=lambda _: None)
|
|
content, usage = llm.chat(
|
|
"用户提示",
|
|
model="MiniMax-M3",
|
|
system="系统提示",
|
|
retries=0,
|
|
run_id="run-1",
|
|
caller="parse-book",
|
|
persist_call=events.append,
|
|
)
|
|
finally:
|
|
llm.requests.Session, llm.time = old_session, old_time
|
|
|
|
assert (content, usage) == ("模型输出", USAGE)
|
|
assert len(events) == 1
|
|
event = events[0]
|
|
assert event["run_id"] == "run-1"
|
|
assert event["caller"] == "parse-book"
|
|
assert event["requested_model_id"] == "MiniMax-M3"
|
|
assert event["actual_model_id"] == "MiniMax-M3"
|
|
assert event["usage"] == USAGE
|
|
assert event["duration_ms"] == 0
|
|
assert event["stop_reason"] == "stop"
|
|
assert json.loads(event["prompt"]) == {
|
|
"messages": [
|
|
{"role": "system", "content": "系统提示"},
|
|
{"role": "user", "content": "用户提示"},
|
|
],
|
|
"model": "MiniMax-M3",
|
|
"max_tokens": 512000,
|
|
"temperature": 0.2,
|
|
}
|
|
assert json.loads(event["response"])["choices"][0]["message"]["content"] == "模型输出"
|
|
|
|
|
|
def test_governed_forwards_persistence_context_to_actual_model_call():
|
|
"""额度治理选出的实际模型必须继续携带 run/caller/持久化适配器。"""
|
|
calls = []
|
|
|
|
def fake_chat(prompt, model=None, **kwargs):
|
|
calls.append((prompt, model, kwargs))
|
|
return "ok", {"prompt_tokens": 1, "completion_tokens": 1}
|
|
|
|
old_now = llm._now
|
|
old_read = llm._read_window
|
|
old_bump = llm._bump_window
|
|
old_chat = llm.chat
|
|
old_pricing = llm._PRICING_CACHE
|
|
try:
|
|
llm._now = lambda: __import__("datetime").datetime(2026, 7, 16, 12, 0)
|
|
llm._read_window = lambda _: (0.0, 0)
|
|
llm._bump_window = lambda *_: (0.0, 1)
|
|
llm._PRICING_CACHE = dict(llm.PRICING_FALLBACK)
|
|
llm.chat = fake_chat
|
|
marker = object()
|
|
content, _, used = llm.chat_governed(
|
|
"prompt",
|
|
run_id="run-2",
|
|
caller="extract-knowledge",
|
|
persist_call=marker,
|
|
)
|
|
finally:
|
|
llm._now = old_now
|
|
llm._read_window = old_read
|
|
llm._bump_window = old_bump
|
|
llm.chat = old_chat
|
|
llm._PRICING_CACHE = old_pricing
|
|
|
|
assert (content, used) == ("ok", "MiniMax-M3")
|
|
assert calls[0][2]["run_id"] == "run-2"
|
|
assert calls[0][2]["caller"] == "extract-knowledge"
|
|
assert calls[0][2]["persist_call"] is marker
|
|
|
|
|
|
def main():
|
|
for test in (
|
|
test_chat_emits_a_complete_persistence_event,
|
|
test_governed_forwards_persistence_context_to_actual_model_call,
|
|
):
|
|
test()
|
|
print(f" ✓ {test.__name__}")
|
|
print("全部通过")
|
|
|
|
|
|
if __name__ == "__main__":
|
|
main()
|