死圈根因(双评审坐实):产物带小红线违规→check FAIL→agent 想修但只有整文件覆盖的 write_file→改3行变重写22KB→MiniMax 漏 path 连撞→stuck 熔断→九门没跑→ok=False。 fix①-A:cheap_run.edit_file(读现文件→校验 old 唯一命中→精确替换→经 write_file 回写继承 L1_FIXED/game_dir 保护)+ cheap_toolkit edit_file 工具(whitelist 把关)注册进 七工具面;edit_file 加入软停 blocked-tools(middleware.py,越软停线同 write_file 拦)。 edit 自身失败面(old 未找到/不唯一)给结构化提示。6 单测(命中/未找到/不唯一/L1拒改/ 越界/缺文件)+ 现有 toolkit 8 测全绿。 fix②-prompt(cheap_roles.py):① 工具清单纠正为七工具、明确 edit_file 小改优先(修 之前"没有 edit_file"的错误引导——否则 agent 不会用新工具);② 克隆纪律"rng/nowMs 照 _template 逐字克隆、禁自造 Math.random/Date.now 防御回退、check 函数内裸调照拦"; ③ check-early"先写最小核心→立即 check→edit_file 修红线→再扩玩法"。 待续(本计划剩项):fix②-check 报错行号(tools.mjs)、fix③ brief 落 evidence、 fix①-B 共享 tier2 熔断窄口径纠偏(最险另做)、n=5 收敛环(ok=True 判据)。 Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
tier2 · 富游戏自治生成线
这是绘境 AI 的第二条游戏生成线。它和现有的超休闲廉价线(wg1/ + LittleJS)解耦并存、运行期零耦合:廉价线用便宜模型往声明式数据壳里填空、做单局几何色块小游戏;tier2 则给一个 AI agent 一台完整的游戏工作站——读文档、写多个 Phaser 源文件、构建、在真浏览器里真玩验收、看截图、查资产——让它在一圈确定性验收门的笼子里反复迭代,把现有产线做不出的多系统富游戏(合成、经营、挂机这类肥鹅美食街档)逼出来。
底座是 AgentScope 2.0.3(独立锁版、独立 env),引擎选 Phaser/Pixi(过无头硬筛、按 AI 作者视角取生态厚度)。生成范式是约束自治(O2):把一款游戏拆成数据表、系统骨架、表现层三层,用骨架和插件 API 锁住系统层最难的部分,把便宜模型的火力集中到必须写的约 56% 表现层,再用三层校验和四道熔断把自治关在笼子里。
整条线最深、也最没证过的赌注是:便宜或中等模型的自治 agent 能不能稳定写出那 56% 的表现层。所以建设按「顺序软、判据硬」走——先把集成和环境搭扎实,再用 M3(写代码逻辑)+ mmx(产美术音乐)连续迭代;但生成证据的判据保持离散可判定:M3 证路是软门、便宜档 n≥30 是硬门、退路树沿用数字触发线,只有硬门通过才投入重机器。
怎么读
- 要建什么、为什么:
docs/brainstorms/2026-06-22-tier2-整体实现方案-requirements.md(WHAT,已过双评审)。 - 怎么建(照这个动手):
docs/plans/2026-06-22-003-feat-tier2-富游戏自治生成线-plan.md(HOW,10 单元,Phase A 详 / Phase B 纲要)。 - 接手须知:
HANDOFF.md(本次 6c6g 初始化交付了什么、Mac 接着做什么、环境切分)。 - 模块边界与红线:
.agent。 - AgentScope 2.0.3 真实 API:
.agents/knowledge/agentscope-2.0-facts.md(拿不准先读/root/oss/agentscope源码 + agentscope-skill 的references/v2-*.md离线镜像;该 skill 的 SKILL.md 正文示例是 1.x,勿照抄)。
现状
2026-06-22 在 6c6g 完成项目初始化:模块骨架、独立依赖(agentscope==2.0.2)、governance、forbidden-import CI 就位。实现与运行调优转交 Mac / mini-desktop(真跑需 chrome/headless+esbuild,6c6g 禁 chrome)。