games-development-ai/docs/agent-specs/2026-07-03-生成引擎agentic架构-第一性重推演与差量-设计.md

149 lines
24 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

---
date: 2026-07-03
topic: 生成引擎架构第一性重推演
status: 已裁(创始人 2026-07-03「一次性裁决」,裁决表见 §5 开头;落地 = 作战清单 W-ARCH 批)· 双评审已过(Codex 一评 P0×1/P1×3/P2×1 全采纳修订、Δ 清单扩为 Δ1Δ9;Opus 二评 PASS、九条修复核验落实、新增 2 P2 已修)(fable 轨2 产出;本档不动现行架构与任何代码,裁决经工单落地)
sot-impact: 本档不改 SoT;Δ9 含「拟改图说 §三协议表」的主张(A8A13 编号时机 / verdict gate-pack 组合 / tier 不进契约字段),仅为待裁主张、裁定前图说维持原状;其余差量若被采纳,修订触点=运行时图说(§三契约表增 PlaySpec/VerdictFeedback 两行、§5.3 续修原语、§5.2 预算两段式)、验收门(门金标回归集)、游戏质量与爆火能力 §8(反馈契约对齐)、数据飞轮(血缘优先级);证据基底=同日一致性对账 report
上级: docs/architecture/架构/生成引擎/agentic运行时架构图说.md
---
# 生成引擎 agentic 架构:第一性重推演与差量(2026-07-03)
## 0 一图看懂
```mermaid
flowchart LR
subgraph ASSET["资产面(沉淀什么)"]
LIN["源工程血缘 DAG<br/>generate/modify/remix 三种边<br/>节点=版本(hash+构建profile+provenance)"]
PACK["品类资产包+插件库+判例库<br/>(设计skill/脚手架/few-shot/rubric)"]
end
subgraph EXEC["执行面(怎么跑)"]
RUN["无状态单写 run<br/>脚手架起手→有界 ReAct→构建"]
REPAIR["统一有界重写原语<br/>(生成中修复=A11模块重生成=remix编辑)"]
ESC["局内升档梯子<br/>(卡住的最小失败面,预算内换强模型)"]
end
subgraph JUDGE["裁决面(谁说了算)"]
GATE["确定性门栈(gate-pack 组合)<br/>发布权唯一来源,自带金标回归集"]
FB["VerdictFeedback 契约<br/>门裁决→结构化可行动反馈"]
SPEC["PlaySpec 考卷契约<br/>游戏声明怎么被玩/被判"]
end
subgraph GOV["治理与观测面(横切)"]
BUD["预算两段式:软停线+硬地板<br/>上界永远可证明"]
TRACE["trace 台账 traceId→gameId 全链可 join<br/>成本只认计费平面"]
end
RUN --> GATE
SPEC --> GATE
GATE --> FB --> REPAIR --> RUN
REPAIR -.失败面仍卡.-> ESC
GATE -->|过门+合规| PUB(("发布入 feed"))
PUB -->|玩家真数据| LIN
LIN -->|校准单·治理门| PACK -->|先验变好| RUN
```
![第一性重推演总览](assets/rethink-00-第一性重推演总览.svg)
上面的 mermaid 是流水线的机器可读事实源,这张门面图把整份重推演的骨架铺成一眼可读的三段。顶部是方法链五步:只取产品需求、项目目标、已冻架构三层输入(刻意不看详细设计),推出 G1G5 目标函数(北极星 = 可信发布率每元),落成资产 / 执行 / 裁决 / 治理观测四个面,再与现行图说对照——推到同一面墙的是互证,推岔的才是待裁差量。中段是四个面的形状:资产面把每一单沉淀成版本化的源工程血缘 DAG 与共享资产包,执行面用无状态单写 run 加一条统一的有界重写原语(生成中修复、A11、remix 是同一件事),裁决面以确定性门栈作发布权唯一来源、外加 PlaySpec 考卷与 VerdictFeedback 判卷两份一等契约,治理观测面横切三者、保证预算上界可证明、一切可按 gameId join。底下的闭环点出护城河所在:门过后发布入 feed,玩家真数据经血缘与校准单固化回品类资产包,让下一单的先验变好。最后一排是 Δ1Δ9 的裁决落点,按三态着色——已落地(C5/C6 契约、Δ6 叙事、Δ9① 注记已回库,画实线)、已采纳(预算两段式、判例库、立宪、能力旗标,裁定采而工单在排)、backlog(重写原语合一、升档梯子、血缘三件、gate-pack 取代 per-tier fork,采而排在放量或 A11 e2e 之后)。判法与差量的细节以正文各节与 §5 裁决表为准。
## 1 这次推演的输入、方法与用途
**输入只取三层,刻意不看详细设计**:产品需求(一句话→可上线可变现的小游戏、feed 即点即玩、创作后可对话调整、做同款、三条变现线);项目目标(生成成功率 ≥80%、便宜档 <¥10/富档 <¥50、16 周日历闸门、基础设施 <¥5,000/月、小团队 AI 驱动开发、**护城河=数据/网络效应/资产/合规而非生成引擎本身**);已冻架构要求(AgentScope 统一编排、三档按 AI 参与深度、引擎按表现复杂度选 LittleJS/Phaser、全模板化去超休闲、采标准+自研仅两块、contract-first、Nacos/RocketMQ/Sentinel 生产 runtime、new-api 计费收口)。
**方法**:先从这三层独立推导出"我会立什么目标、画什么方案",再与现行图说对照。推到同一面墙的,是对现行架构的方向性互证;推岔的,才是值得拿出来裁的差量。这份互证的强度要如实标定:推演与对账同日完成、共享同一批仓内事实,不是双盲——它能提示承重墙选对了,不能单独作证明。对照的现状证据一律引自同日[一致性对账 report](2026-07-03-生成引擎-实现与图说一致性对账-report.md)(下称"对账"),不凭印象。
**用途**:给创始人一份"如果换个脑子从头设计,会不会走到别处"的判卷,以及八条可逐条裁的差量。它不是第二份架构 SoT——canonical 唯一性不动,采纳的差量按正常工单流程改图说与代码。
## 2 我会基于什么目标来设计(目标函数,按序)
**G1 可信发布率每元(北极星)。** 引擎的产出不是"生成了游戏",是"机器可证可玩、且够丰富到值得进 feed 的游戏"。≥80% 成功率与 <¥10 单价不是两个目标,是同一个比值的分子分母——所以唯一北极星是:每花一块钱,产出多少个**可信可发布**的游戏。所有子系统投资都对着它算:验收门抬"可信"、模板与插件压"每元"、反馈回路抬转化率。
**G2 反馈闭环密度。** LLM 是系统里唯一的不确定件,平台的全部职责是**把不确定性转换成信息**:任何一次失败都必须产生结构化、可归因、可行动的信号——给 agent(修复)、给运营(分诊)、给资产层(校准)。没有反馈的重试是买彩票,80% 不可能靠彩票凑出来;这也是"确定性验收门"真正的价值所在——门不只是拦截器,门是**信号发生器**。
**G3 资产复利。** 护城河命题说得很清楚:模型迟早人人都有,搬不走的是数据、资产、血缘网络。那么架构必须让"跑一单"天然沉淀资产——每一局的源工程、play-spec、verdict、成本、玩家真实数据,都要能按 gameId 串起来回流,经治理门固化进品类资产包(few-shot/数值锚/rubric),让下一单的先验变好。跑完即散的架构,再高的成功率也只是成本中心。
**G4 尾部有界。** UGC 规模的分发平台,单局失控的代价不是钱是命(成本失控、违规内容进 feed、发布权被模型自评骗过)。所以三条不变量:成本与时长的**上界永远可证明**(闸可以软,界不能无);发布权只属于确定性门栈+合规门,LLM 永不自评放行;出题者与被考者永不同源。
**G5 接缝按变更频率设,不按理论对称性设。** 小团队、16 周,每一道抽象都是负债。真实的变更频率排序是:**模型月换 > 品类周扩 > 引擎季增 > 编排框架可能永不换**。所以接缝投资按这个序:模型与 prompt 做成数据(注册表/热配)、品类做成资产包(纯数据+skill)、引擎做成能力包+探针实现(一对接口)、框架适配器排最后——有一套能跑的就够,第二套等真需要再花钱。任何接口在只有一个真实现时不冻结(rule-of-three)。
## 3 设计方案(从目标推出的形状)
### 3.1 总体:一条把不可靠输出精炼成可信资产的流水线,四个面
生成引擎 = **LLM 唯一不确定,其余全部确定化**的精炼管线。四个面各管一件事,汇在 §0 那张图上:
**资产面——一切围绕"版本化源工程的血缘 DAG"组织。** 节点是源工程版本(contentHash + 构建 profile + 依赖锁,保证两年后原样可构建);边只有三种:generate(从一句话新建)、modify(A11 对话调整)、remix(做同款,跨创作者派生)。每个节点挂 provenance:用了哪个模型@版本、哪份 prompt@版本、花了多少钱、过了哪些门、用哪份 play-spec 判的。品类资产包(设计 skill、脚手架、few-shot、rubric)与 L2 插件库是共享资产,只能经治理门(校准单→人审→版本化发布→观察窗对照→劣化即 revert)更新。**血缘字段从第一天就在源工程契约顶层**——它是分成、防刷、网络效应度量、回流归因的共同地基,事后补的血缘永远缺最早那批数据。
**执行面——无状态单写 run + 统一的有界重写原语。** 每单现组装、跑完即弃,状态全部外置可续跑;整工程只有一个写者(多写者共享状态必然互相踩,这是用真教训换来的约束,与现行一致)。生成流程:脚手架起手(平台预建、先天能 boot)→ 轻设计(品类资产包给设计先验)→ 有界 ReAct 实现 → 构建 → 送裁决面。**修复不是重掷,是定向手术**:裁决面回来的结构化反馈指向最小失败面(某文件/某系统/某数值面),对它做一次有界定向重写,不碰已验证模块——这个原语与 A11 的"模块重生成"、remix 的"改我想改的那部分"在语义上是**同一件事**,应当只有一条代码路、同一组完成断言(改动真实生效/非目标面字节稳定/血缘可查)。修复若干轮仍卡在同一面上,走**局内升档梯子**:只对那个失败面换强模型再试(预算带内),而不是整局报废或整档换模型——买成功率只花尾部的钱。
**裁决面——门栈是发布权的唯一来源,同时是反馈的唯一来源。** 判定纪律与现行完全一致(真玩取证、零 LLM 参与硬门、出题≠被考、LLM 只做非阻塞的丰富度评分)。结构上有两点我会立得更硬:门按 **gate-pack 组合**(基础可玩包+品类不变量包+富游戏包),而不是按档 fork verdict schema——品类会周扩,档位耦合会让 schema 长成排列组合;**门自带金标回归集**——每一个被证实的误杀/漏放案例永久变成门自己的 fixture,门的判据改动必须先过自己的考试。围绕门立两份一等契约,见 §3.2。
**治理与观测面——上界可证明,一切可 join。** 预算是两段式:软停线(越线只许收尾类动作、交尽力产物——给续修留活路)+ 硬地板(轮数×单步上限+总墙钟+收尾预算带,¥ 上界数学上封死)。trace 台账以 traceId→gameId 为主键全链可 join(生成特征×门裁决×成本×玩家行为×收益),成本只认计费平面的 quota 行、不信模型自报。配置两类:影响质量与安全的走受治理发版(版本账本+审批),运营开关热改——载体用什么(Nacos/yudao)是采购问题不是架构问题。
### 3.2 契约清单(比 A1A13 少五条,多两条)
固定契约九份,每份**必须随附机器校验器进 CI——没有校验器的契约只是文档**(这个项目两周内先后为文档漂移、驱动器约定、play-scene 结构各补过一道事后机器门,说明这条应当是宪法而不是补丁):
| # | 契约 | 管什么 | 与现行 A1A13 的关系 |
|---|---|---|---|
| C1 | 任务与状态 | 提交/幂等/回调/取消副作用/状态机 | ≈A1+A2(状态命名对齐 A2A 即可,不必真建 A2A server——现行 `toA2aStatus()` 投影层就是正解) |
| C2 | 源工程与血缘 | 文件树/入口/构建 profile/依赖锁/contentHash/**lineage 顶层字段** | ≈A3+A3.5,血缘从可选远期升为一等字段 |
| C3 | 装载 | host boot/latch 轮询/分流 | =A4+A4.5 |
| C4 | 工具签名 | write/build/check/run_gates/finish(finish=C2 同 schema) | =A7 |
| C5 | **PlaySpec 考卷** | 游戏声明"怎么玩我以便判我":起局仪式、驱动器族、输入指令表、赢输可观测量;**由源工程派生,源变即重生** | **新增**——现行是 harness 内部实现细节,靠 `targets` 键隐形约定选驱动器、spec 已存在不覆盖(对账 §3 发现六),两处都是它缺位的病征 |
| C6 | **VerdictFeedback 判卷反馈** | 每次未过门必带:哪门、卡在哪个阶段(phaseNow)、用的哪个 driver、证据指针(console/log/截图)、疑似失败面、修复方向类 | **新增**——图说预言"收敛强依赖响亮可修反馈"却没把反馈立成契约;便宜档盲修空转与 tier2 F-1 反馈补厚是两条产线在同一缺口上先后摔的跤 |
| C7 | 验收 verdict | decision/severity/gate-pack 逐门证据 | =A5;gate-pack 组合取代 per-tier fork 的取舍列 Δ9 待裁 |
| C8 | trace 与成本 | 五字段核心+扩展段;traceId→gameId join 键 | =A2.5,加 join 键不变量 |
| C9 | 预算策略 | 档位软停线/硬地板/收尾预算带/升档梯子额度 | 现行散在 §5.2/§5.3 叙述里,聚成一份可校验配置 |
清单与图说 §三的差异要说透:A6 探针钩子在本清单降为 C5 的 per-engine 实现约定(第二引擎落地才冻,与图说 rule-of-three 同理);而 A8A13 平台面六条是否预先编号进固定协议目录、以及 C7 的 gate-pack 取舍,是本档与图说的真分歧——**不在此处顺带成立,单列 Δ9 待裁,裁定之前图说 A1A13 固定协议目录维持原状**。
### 3.3 档位:两条生产道,深度是参数不是身份
按 AI 参与深度分三档(Tier0/1/2)是创始人已冻口径,对外产品与排期口径不动。实现视角上,这三档可以理解为**两条生产道 + 一个连续参数**:便宜道(模板重、插件承重、LittleJS)与富道(骨架+agent 写系统层、Phaser),"AI 写多深"是 run 级参数(写白名单的宽窄、预算带、gate-pack 组合)——Tier0/1 在实践里已经合流(同为 A-model 写真 src/,差别只是自由度),这个理解模型只作解释、不构成改动。真正构成差量的是契约字段层面的主张:schema 里不编码 tier 枚举、用能力旗标+预算档表达(品类×档位×引擎的组合迟早撑爆枚举)——该主张列 **Δ9** 待裁,裁定前一切契约维持现状。
## 4 对照:两条独立路径推到同一面墙的地方(互证)
以下现行设计,我从第一性推导也会原样落到——这组**设计选择**本身不该动(实现层的兑现缺口是另一回事,见对账):**确定性验收门为信任内核**(竞品能让模型吐代码,不能机器化证明可玩——这是真护城河);**全模板化、去超休闲**(可信发布率每元的直接推论);**单写者**;**有界续修而非无界自治**(0 号 spike 证明纯放开 ReAct 会过早放弃,与我"反馈驱动的定向手术"同型);**L3 效果永不当门**(防 Goodhart 的唯一稳定解);**observe→enforce 渐进赋权**;**n=5 收敛环而非 n≥30**(MVP 阶段买"能不能收敛"的信息,不买统计置信);**出题≠被考 + driver 对抗评审**;**改源不改包、游戏=长生命周期项目**;**成本收口 new-api 单一计费平面**;**单框架收敛、SAA/dify 降级**(接缝按变更频率排序的直接推论——现行是被 06-25 reframe 纠回来的,我会第一天就这么选)。
这份互证的分量要如实标定:实现被真跑毒打两周后,除便宜档续修反馈链一处违背外核心纪律守住(对账总判),同一天的重推演又落在同一组承重墙上——它提示骨架大概率选对了;但推演与对账共享事实基底、非双盲,这是方向性互证,不是证明。
## 5 差量 Δ1Δ9(每条:证据→建议→代价→去处)
> **裁决记录(创始人 2026-07-03「一次性裁决」,即时生效;数值为生效草案值,单位经济或模型单价大变即复审;落地拆单 = [MVP作战清单](../mvp/MVP作战清单.md) W-ARCH 批)**
>
> | 项 | 裁定 | 生效口径 |
> |---|---|---|
> | 预算口径(含 Δ7,消对账发现一) | **采两段式** | 软停线维持 ¥10/¥50;越线只许收尾类动作(finish/构建/跑门,禁新增大额生成调用);整局 RMB 硬地板 = 软停线 ×1.5(便宜档 ¥15 / 富档 ¥75),与轮数/墙钟闸任一先到即停;生产 Service / CLI / 图说三处统一 |
> | Δ1 考卷+判卷反馈契约 | **采·立即** | C5/C6 schema+校验器+负样本落 `contracts/`,并入 W-S1 修复三单收口面;tier2 `verdict_feedback` 对齐 C6 |
> | Δ2 统一有界重写原语 | **采·缓** | 排 A11 计费 e2e 之后,质量轨 backlog 立单;在飞验收面不动 |
> | Δ3 局内升档梯子 | **采 spike,不采直接上线** | F-2 干净复跑后做 A/B spike(升档 vs 纯 M3);四前置清了才谈生产;作 go/no-go 终审备选杠杆 |
> | Δ4 门金标判例库 | **采** | 判例集中位(harness 树内或 contracts/gate-fixtures/)+ 门判据改动必过全量判例 |
> | Δ5 契约=schema+校验器 | **采·立宪** | engineering-conventions 增补:新契约 DoD = schema+校验器+负样本进 CI |
> | Δ6 叙事重心 | **采** | 随 W-DSGN doc-sync 修图说 §一表述(契约脊柱与 judge 独立保留;框架适配验证明确为远期非投入项) |
> | Δ8 血缘三件 | **采·绑放量** | 与放量决策(决策包⑤)同批启动,放量后首周内落地;未落地不继续扩大放量 |
> | Δ9 契约表面三主张 | **①采注记 ②缓裁 ③新增遵此** | ①图说 §三协议表 A8A13 加"单实现期不冻、第二消费者出现才逐条抬升"注记(不删行);②gate-pack 取代 per-tier fork 列品类扩产后的观察项、现不动任何 schema;③新契约字段不编码 tier 枚举(能力旗标+预算档),存量 schema 不迁移 |
**Δ1 把 PlaySpec 与 VerdictFeedback 立成一等契约(最高优先)。** 证据:对账发现六——驱动器选择靠隐形 `targets` 键、spec 不随续修重生、反馈丢 phaseNow/driver/game-log、CLI 路不回喂;tier2 侧 F-1 补厚做的正是同一件事的富游戏版。建议:按 §3.2 C5/C6 立 schema+校验器,修复三单的单①单③以此为契约面收口,tier2 的 verdict_feedback 与便宜档 gate_judge 对齐同一份 C6。代价:小-中(三单已在改,增量是把改法钉成 schema;C5/C6 的校验器与负样本按 Δ5 的 DoD 标准另计工作量)。去处:并入 W-S1 修复三单终审,schema 落 `contracts/`
**Δ2 统一"有界定向重写"原语。** 证据:生产已自发长向它——RepairMiddleware 两档共用(对账 4.1#6、4.2#4),A11 模块重生成+三断言另立一套(`cheap_modify`/`cheap_assert`);remix 将来还要第三套。建议:一条原语(输入=源工程版本+目标面+写白名单+预算带,输出=新版本+三断言证据),生成中修复、A11、remix 全部调它。代价:中(A11 已完成待 e2e,合一动作应排在计费 e2e verify 之后,避免动在飞验收面)。去处:质量轨 backlog,排 A11 e2e 后。
**Δ3 局内升档梯子。** 证据:tier2 收敛环 conditional 的瓶颈是 M3 自调赢/经济平衡不稳(约 1-2/5),现行退路是批级"换档"(整线换强模型);创始人已裁退路在 agent 层。建议:在 C9 预算契约里给"升档额度"——同一失败面连续 N 轮未修通,只对该面(如数值表/平衡面)换强模型一次,预算带内封顶;F-2 干净复跑时可顺带做 A/B 取证(升档梯子 vs 纯 M3)。代价:**中-高,须先 spike**——失败面分类是否可靠、局部重写边界怎么圈、模型切换点怎么落(现行 writer 模型在 agent 构造期一次定死,`tier2/gen-worker/worker/agent_loop/studio.py:375`;预算中间件只管成本与熔断、不管按失败面换模型)、trace 归因与预算封顶,四件都清了才谈上线;风险=成本方差变大,必须与收尾预算带同批。去处:W-S2 F-2 之后、go/no-go 终审的备选杠杆,创始人裁。
**Δ4 门金标回归集升格为命名架构资产。** 证据:项目文化里已经在做(latch 误杀五款基线、check 门 8 正样本 0 误报、4 例实证失败模式全拦),但它们散在各次提交叙述里,没有一个"判例库"位置与 CI 挂载。建议:`contracts/gate-fixtures/`(或 harness 树内)集中收误杀/漏放判例,门判据任何改动必须先过全量判例;quality canonical §10 校准时同步扩充。代价:小。去处:W-DSGN 或质量轨小工单。
**Δ5 "无校验器不算契约"立为宪法条款。** 证据:两周内 docs-gate、check 门第 6 节、AST play-scene 门、G7 谱系门全是**事后**为漂移补的闸;每次都有效,每次都晚。建议:engineering-conventions 加一条——新契约/新协议字段合入的 DoD 包含其机器校验器与负样本;评审时按此拦。代价:近零。去处:`.agents/rules/engineering-conventions.md` 增补,随下次规则修订。
**Δ6 叙事重心从"框架可插拔"改为"按变更频率设缝"。** 证据:现实已经用脚投票——A2A 是投影层而非 server、OTel 非落库源(自研 TraceAdapter 承重)、SAA/dify 降为远期、MCP 加性默认关(对账 4.3);真正月月在换的是模型与 prompt,周周在扩的是品类。建议:图说 §一的"第一原则"改述为接缝频率序(协议脊柱与 judge 独立这两个由可插拔执念产出的真资产原样保留),防止后人按旧叙事把钱花在框架适配验证上。代价:纯文字。去处:随 W-DSGN doc-sync 一并改。
**Δ7 预算两段式明确化。** 证据:对账发现一——fail-closed 红线已被 07-02 决策软化,SoT/生产/CLI 三处取值不同,且软化后 ¥ 上界从显式变隐式(靠轮数与超时间接兜)。建议:按 §3.1 治理面立两段式(软停线+收尾预算带+硬地板),把"上界可证明"写回 SoT——软停不等于无界;三处统一取值。代价:小(机制大半已在,补收尾预算带与文档回同)。去处:决策包裁定项,随发现一一起给创始人。
**Δ8 血缘升为源工程契约一等字段、join 键放量前落地。** 证据:数据飞轮 SoT 自己坦白 contracts 零血缘字段(grep lineage/parent/remix 零命中)、收益表无 game_id 列——数据护城河目前是"进数据、难归因"。飞轮阶段三与 W4 链已在补,方向一致;差量是**优先级主张**:放量(对外开闸)之前至少完成三件——源工程契约的 lineage 顶层字段、血缘边表(含 pending/active 激活状态机)、trade 收益侧 game_id 透传(W4 四步链),否则首批最珍贵的种子用户数据生下来就是断链的;remixFrom API 与完整防刷随飞轮阶段三排期、不抢放量窗口。代价:中(按数据飞轮 SoT 分阶段落,不是一个 additive 字段的事)。去处:与 M3 放量决策(决策包⑤)绑定排序,创始人裁。
**Δ9 契约表面的三处收敛主张(纯待裁;裁定之前,图说 §三 A1A13 固定协议目录与既有 schema 全部维持原状)。** ①A8A13 平台面六条缓编号:等各自出现第二个消费者再逐条抬升为固定协议——单实现期冻结接口必被唯一实现反向决定,这是图说自己的 rule-of-three 在协议表层面的应用,图说也承认这六条"埋在单线实现里"。②verdict 按 gate-pack 组合取代 per-tier fork:基础可玩包+品类不变量包+富游戏包自由组合;品类周扩之下 per-tier fork 会长成排列组合(现状证据:A5 已为 tier2 fork 出第二份 verdict schema)。③tier 不进契约字段,用能力旗标+预算档表达(对外 Tier0/1/2 口径不变,见 §3.3)。代价:①③近零(本质是"不做"的主张),②中(schema 迁移+消费方改造)。去处:创始人裁;若采纳,修订图说 §三协议表(frontmatter sot-impact 已申报此拟改)。
## 6 不做清单(负空间,与现行一致处不重复)
MVP 内不做:多框架适配验证(接缝=契约本身,第二框架永远可以后接)、独立 MCP server 面(进程内 FunctionTool+shell-out 够用,第二个跨进程消费者出现才立)、microVM/独立 durable-execution 引擎(队列重投+外置状态已覆盖)、可视化建图器、统一"质量总分/爆火分"(质量 canonical 已裁四层不合成)、n≥30 统计批跑、为 CLI 路补齐与 Service 同级的续修承诺(二选一:回喂对齐,或降格声明为 lab 工具——见对账 §6)。
## 7 风险与失效条件
本档是 2026-07-03 快照上的推演:引用的行号与工单状态会漂,以 git 与在飞板为准;若创始人对预算、升档、血缘优先级另有裁定,以裁定为准、本档相应差量作废留痕。Δ3 引入成本方差,必须与 C9 收尾预算带同批落地,单独上线视为违背 G4。Δ2 触及 A11 已验收面,排期红线=计费 e2e 之后。全档未运行任何代码,工程判断以对账 report 的静态证据为限。