软停(budget_soft_tripped)已有 on_system_prompt 强提醒 + on_acting 拦生成类工具,但那是被动系统提示, M3 可能烧推理不理会(80011 实录:软停触发后仍烧到 step_cap/硬地板才停)。本次在共享 CircuitBreakerMiddleware 加「finish 逼近升压」:on_reply 用现有事件计数面数软停后连续无-finish 的 acting 轮(ToolCallStartEvent +1; 一推理轮无 tool call=finish 尝试则轮边界复位),达 N=3 轮升第一档(提醒收尾)、达 2N=6 轮升第二档(强制立即 finish、禁新增大额生成);升压指令经 on_acting 注入工具结果(拦截语并入 / 收尾类结果尾部附加),跨档只注一次。 只改观察/注入路径与状态跟踪:不动任何熔断阈值 / finish 语义 / 九门;无新增配置键(_softstop_rounds 派生); _softstop_rounds=0 时 on_acting 与升压前逐字节等价(兼容既有 cheap 共享面)。cheap_budget 同源共享,不改 cheap 文件。 新增 tests/test_softstop_escalation.py(5 用例):升压逐档升级 / 透传附加 / finish 尝试复位 / 不足 N 轮零升压 / 硬地板仍兜底。 验证:tier2/gen-worker 102 passed;cheap-worker 共享软停面 29 passed(test_budget_two_stage 等)。 Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
tier2 · 富游戏自治生成线
这是绘境 AI 的第二条游戏生成线。它和现有的超休闲廉价线(wg1/ + LittleJS)解耦并存、运行期零耦合:廉价线用便宜模型往声明式数据壳里填空、做单局几何色块小游戏;tier2 则给一个 AI agent 一台完整的游戏工作站——读文档、写多个 Phaser 源文件、构建、在真浏览器里真玩验收、看截图、查资产——让它在一圈确定性验收门的笼子里反复迭代,把现有产线做不出的多系统富游戏(合成、经营、挂机这类肥鹅美食街档)逼出来。
底座是 AgentScope 2.0.2(独立锁版、独立 env),引擎选 Phaser/Pixi(过无头硬筛、按 AI 作者视角取生态厚度)。生成范式是约束自治(O2):把一款游戏拆成数据表、系统骨架、表现层三层,用骨架和插件 API 锁住系统层最难的部分,把便宜模型的火力集中到必须写的约 56% 表现层,再用三层校验和四道熔断把自治关在笼子里。
整条线最深、也最没证过的赌注是:便宜或中等模型的自治 agent 能不能稳定写出那 56% 的表现层。所以建设按「顺序软、判据硬」走——先把集成和环境搭扎实,再用 M3(写代码逻辑)+ mmx(产美术音乐)连续迭代;但生成证据的判据保持离散可判定:M3 证路是软门、便宜档 n≥30 是硬门、退路树沿用数字触发线,只有硬门通过才投入重机器。
怎么读
- 要建什么、为什么:
docs/brainstorms/2026-06-22-tier2-整体实现方案-requirements.md(WHAT,已过双评审)。 - 怎么建(照这个动手):
docs/plans/2026-06-22-003-feat-tier2-富游戏自治生成线-plan.md(HOW,10 单元,Phase A 详 / Phase B 纲要)。 - 接手须知:
HANDOFF.md(本次 6c6g 初始化交付了什么、Mac 接着做什么、环境切分)。 - 模块边界与红线:
.agent。 - AgentScope 2.0.2 真实 API:
.agents/knowledge/agentscope-2.0.2-facts.md(拿不准先读/root/oss/agentscope源码 + agentscope-skill 的references/v2-*.md离线镜像;该 skill 的 SKILL.md 正文示例是 1.x,勿照抄)。
现状
2026-06-22 在 6c6g 完成项目初始化:模块骨架、独立依赖(agentscope==2.0.2)、governance、forbidden-import CI 就位。实现与运行调优转交 Mac / mini-desktop(真跑需 chrome/headless+esbuild,6c6g 禁 chrome)。