diff --git a/docs/系统架构/新版设计/模块设计/B04-知识方法.md b/docs/系统架构/新版设计/模块设计/B04-知识方法.md index edceb83..6aef77c 100644 --- a/docs/系统架构/新版设计/模块设计/B04-知识方法.md +++ b/docs/系统架构/新版设计/模块设计/B04-知识方法.md @@ -19,6 +19,7 @@ | record_usage | 上下文、实际片段与结果引用 | 不可变消费关联 | | 读取方法评测材料 | 维护事务、作者、具体确认版本ID | 核原确认内容、版本与证据,按S04 generation/evaluation投影;只形成B10受批准的资料快照,不启用方法或写生产消费 | | 核对方法评测投影 | 同用途元数据连接和已封存材料 | 重验内容/结构/字段策略哈希;评测不直接读正式方法表 | +| 读取消费统计 | 作者、方法版本范围 | 按版本聚合的实际消费计数,供 B09 偏好重排的强信号路;只读,不改消费台账,不把被检索或任务成功当作消费 | 所有接口在本模块的接口.py 暴露。输入输出类型由同一公开表面导出,外部不导入私有模型或 SQL。 diff --git a/docs/系统架构/新版设计/模块设计/B05-正文写作.md b/docs/系统架构/新版设计/模块设计/B05-正文写作.md index fca6ef7..d574d89 100644 --- a/docs/系统架构/新版设计/模块设计/B05-正文写作.md +++ b/docs/系统架构/新版设计/模块设计/B05-正文写作.md @@ -9,6 +9,8 @@ B05拥有选段定位和重放,B06复用受控模型修订链、声音保护 原`生成正文`入口只处理new_chapter。先前声明的expand_scene/edit_selection缺少确切圈选且输出整章,不能用来修改既有正文;现由上述选段授权入口承接,旧入口明确拒绝,不以整章生成冒充选段保护。 +选段授权链路可携带参考改写扩展:作者从方法检索中挑选的参考版本作为授权输入进入冻结材料,合同见[B06 参考改写](B06-审校修订.md)。B05 仍拥有选段定位、重放与保真;参考材料不改变选区边界,范围外不变的约束继续成立。 + ## 分支与合并来源 分支从作者点名的已保存正文版本创建,固定源文稿/版本/哈希;新分支有独立正文指针,创建、保存及回退均不派发主线章后抽取。主分支保存及采纳仍按既有事务登记章后任务。 diff --git a/docs/系统架构/新版设计/模块设计/B06-审校修订.md b/docs/系统架构/新版设计/模块设计/B06-审校修订.md index 0593508..19e7579 100644 --- a/docs/系统架构/新版设计/模块设计/B06-审校修订.md +++ b/docs/系统架构/新版设计/模块设计/B06-审校修订.md @@ -175,6 +175,14 @@ S01的`B06.propose_patch` 在同一事务重验诊断与当前依据,再调用 HTTP的`revision-tasks`及CLI的`审校 模型修订/修订报告`共用请求和服务,任务读回核对作者及流程。工作台明确区分作者填写替换和调用一次写手,页面刷新按URL中的诊断与修订任务身份读回;候选仍经既有作者审阅及采纳,机械通过不表示语义或文学收益获证。 +### 参考改写(选段改写链路扩展) + +参考改写不新建流程,扩展选段写作授权(mode=rewrite)的既有受控模型修订链。作者挑选参考发生在流程发起之前:检索候选→偏好重排→作者挑选参考方法版本(可不挑)并可点踩;挑选与点踩经 B07 参考挑选反馈落账,选中的 method_version_id 清单作为授权的一部分进入冻结输入。流程内无暂停点,冻结语义不变;人挑是授权构造的输入,不是流程内交互。 + +冻结修订步骤在既有"修订目标+声音"之外补充两类材料绑定:作者活跃偏好的偏好材料(与生成正文冻结回放同合同)与选中参考方法的原文材料(可选材料语义,受字节预算约束,超预算记省略原因不截断)。两类绑定均入快照;任一来源漂移则快照当前失效,沿用既有依赖复检。 + +工作台交互合同:候选默认高亮重排前三,支持键盘多选与"本次跳过"(跳过不阻塞,等价于不挑参考);每张候选卡显示推荐理由(命中词+历史选用次数),使挑选是知情的;点踩即时落账并影响后续重排。 + ## 持久有限返修会话 `编排.审校修订.发起有限返修`预先固定作者、原正文版本与哈希、诊断或选段授权、writer配置及1至5轮上限。B06先保存会话和待建轮次,再以`session_id + round`派生的确定性命令调用既有`发起模型修订`;任务创建后才登记真实S02任务引用。创建任务或登记之间中断时,重放原命令回收同一S02任务,不重复调用,也不把未登记轮伪装成成功。 diff --git a/docs/系统架构/新版设计/模块设计/B07-作者经验.md b/docs/系统架构/新版设计/模块设计/B07-作者经验.md index 0b7c996..d8b0efb 100644 --- a/docs/系统架构/新版设计/模块设计/B07-作者经验.md +++ b/docs/系统架构/新版设计/模块设计/B07-作者经验.md @@ -23,6 +23,8 @@ | 读取运行观察来源 | 真实S02任务、指定尝试及可选的具名业务来源 | 作者与用途核验后的技术摘要、版本和哈希;只读,不生成观察 | | 记录运行观察 | 上述确切来源定位、具名现象、原话、背景和可选问题键 | 只追加运行观察;同命令和同来源现象幂等,改内容拒绝 | | 读取运行观察 / 列出运行观察 / 检索重复问题 | 当前作者、观察或任务身份、可选问题键 | 历史观察与按实际任务计数的重复问题,不生成效果判断 | +| 记录参考挑选反馈 | 检索回执引用、领域标签、选中与拒绝的方法版本清单 | 只追加参考挑选反馈;进入数值信号轨,不直接生成文本偏好 | +| 读取挑选信号 | 作者、可选领域与方法版本范围 | 选用/拒绝计数与位次聚合,供 B09 偏好重排消费;只读,不改台账 | 所有接口在本模块的接口.py 暴露。输入输出类型由同一公开表面导出,外部不导入私有模型或 SQL。 @@ -54,8 +56,19 @@ 反馈对只接受B05已存在的确切正文或候选版本,核对作者、作品、章节、分支及内容哈希后保存引用、作者原话和决定;不复制正文或修改原候选决定,不把自报反馈当S01采纳证明。反馈幂等键改变内容时拒绝。B07通过公开读取接口恢复版本对;缺失来源不得伪造。 +反馈台账是通用只追加 payload 账本,按 payload 内 `种类` 字段判别:`改写对照`(默认;存量无该字段的记录按改写对照兼容读取)与 `参考挑选`。改写对照沿用下述版本对合同;参考挑选记录作者在方法检索结果上的挑选与点踩:检索查询、领域标签、检索回执引用(含索引代次与有序结果)、选中与拒绝的 method_version_id 清单及挑选时可从回执恢复的位次。位次用于标记位置偏置。参考挑选反馈不引用正文版本、不构成 before/after 对照,幂等键、不可变守卫与评测角色隔离同改写对照。 + 物理迁移使用追加的V0044承接原预留V0011,已执行的其他迁移保持不变。偏好、反馈、改进与观察版本由数据库不可变守卫(V0044–V0046、V0055 的 BEFORE UPDATE OR DELETE 触发器)保证只追加;读路径按已存内容返回,不重算内容哈希——内容身份在写入与边界核对时确认,只报警不恢复的读时重算不进入读路径。该段工程完成不代替具体改进评测、目标owner启停、长期观察或完整经验闭环验证。 +### 偏好双轨关系 + +作者偏好双轨并行,职责不互串: + +- **文本偏好轨**(muse_preference):topic/text/scope 的人可读语句,经偏好材料注入写手提示词,由作者裁决生命周期(pending→active→withdrawn),以偏好绑定进入冻结快照。文本轨不参与检索排序。 +- **数值信号轨**(参考挑选反馈与 B04 消费统计的聚合):仅供 B09 方法检索的偏好重排产生偏好分,权重经人工审查版本化。数值轨不冒充作者偏好,不自动生成生效文本。 + +推断偏好是数值轨到文本轨的受控翻译:确定性聚合脚本(不调用模型)从信号模式产出 origin=inferred 的 pending 偏好,卡片内联证据(如"近 30 次挑选中被选 12 次"),作者显式确认后才 active,确认沿用既有冲突管理合同。护栏:单条推断需 ≥5 个支撑事件才生成;每次呈现摘要 ≤5 条;v1 不做权重自动调参——重排权重只经人工审查的版本号变更,作者主权延伸到排序策略。 + ### 具体方法改进与用途交接 方法改进先引用B04已确认且尚待效果验证的确切版本,并至少绑定一份真实反馈。B07从owner读取版本、内容及投影哈希,保存只追加提案版本;标题或理由变化也需要新版本,不接受调用方自报promoted状态。 diff --git a/docs/系统架构/新版设计/模块设计/B09-上下文.md b/docs/系统架构/新版设计/模块设计/B09-上下文.md index e834fa2..057ba8c 100644 --- a/docs/系统架构/新版设计/模块设计/B09-上下文.md +++ b/docs/系统架构/新版设计/模块设计/B09-上下文.md @@ -30,7 +30,7 @@ | 任务范围.py | 作品、用途、时点和来源权限 | | 来源读取.py | 按业务公开接口读取固定来源 | | 声音材料.py | 经B06读取已认可声音,冻结身份/用途投影并核逐键材料 | -| 混合检索.py | 关键词与向量两路倒数排名融合 | +| 混合检索.py | 关键词与向量两路倒数排名融合及偏好重排 | | 材料装配.py | 必读、预算、取舍及字段投影 | | 探索回放.py | 按同一范围重放工具读取 | | 冻结快照.py | 来源、结构、投影和消费片段 | @@ -89,6 +89,16 @@ A使用连续历史基线及一般关键词补充原文,B仅使用时点卡片 混合检索只读取可用的新鲜方法索引,不自动写入规划选择。空白查询在读取索引前以`CONTEXT_INPUT_INVALID`拒绝。结果保留索引身份;索引无条目时`empty_reason=empty_index`,有索引但两路都无命中时`empty_reason=no_match`并给出作者可读说明。有命中时该字段为null。此合同不改变B04固定绑定材料的列表返回值。 +### 偏好重排通路 + +混合检索在关键词、向量两路 RRF 之上增加偏好路。偏好信号经公开接口取得:B07 暴露参考挑选信号(选用/拒绝计数,带位次偏置标记),B04 暴露消费统计(实际消费计数);B09 不读两者私表。 + +弱强信号分列计数,不混算:参考挑选是弱信号(受位置偏置影响,排序靠前者天然更易被选中),改写采纳与实际消费是强信号。"种类→权重"映射由版本化权重表承担;偏好路初始权重保守(相对双路各 1.0 的量级不超过 0.25),权重表版本号写入检索回执。 + +重排保留 1~2 个探索位:将未被消费过的高相关方法版本注入候选,对抗熟悉度泡沫(挑熟悉的→推熟悉的→方法面越用越窄)。重排是纯函数:同一输入(得分表、信号表、权重版本)得到同一输出。 + +用于冻结任务的检索,其信号表快照与权重版本进冻结快照(沿用偏好绑定先例),保证重排结果可回放、可审计。 + ### 读取前预算与摘要分页 新建任务在 `source_scope` 冻结 `context_policy_version=2` 和 `context_read_budget`。预算唯一默认值在 S02 `上下文预算.py`;输入字节与模型输出 token 分开核算。旧任务不补字段、不改回放哈希,超过部署硬上界返回 `CONTEXT_POLICY_REAUTH_REQUIRED`,由作者重新授权。