lili c372837762
Some checks failed
contract-gates / contract-gates (push) Has been cancelled
docs-gate / docs-gate (push) Has been cancelled
feat(deps): 升级 AgentScope 2.0.2→2.0.3(代码+文档,创始人 2026-07-06 拍板)
不为某个新特性,而是没道理把底座停在带并行 tool-result 缺陷的补丁版;2.0.3
是同线相邻补丁版,升级面窄、收益确定。承 tech-decisions §11-13「护城河进洋葱、
框架件谨慎审计」线。

代码:两 worker requirements 钉 2.0.3+溯源注;4 个 cheap-worker patch 的版本
guard 更 2.0.3——主控逐一源码核实 2.0.3 锚点仍成立:compress_context@_agent.py:259
未漂移 / _parse_stream_response@_openai_chat/_model.py:297·index 分桶:417 未漂移 /
list_tools@_local_workspace.py:660 / get_toolkit 装配点迁 _chat.py:354(patch 替
绑定名不依赖行号);patch 头 pin 声明同步 2.0.3+复核标记,根因 2.0.2 期实证保留。

文档:current-truth 面扫除(agentscope-2.0-facts 改掉一处「2.0.3 是笔误」错陈述+
行号漂移开源码更新 594→622/136→162/33→42/857→884/875→902、tech-decisions §15
升级决策散文、运行时 SoT 当前选型句、活代码注释、tier2 README 死链修);留痕层
(plans/HANDOFF/patch 根因分析/ADR 历史核验句)按两层纪律不动。

兼容三证:源码逐处 diff(RedisMessageBus/OpenAI formatter 零变化、Anthropic
formatter 仅并行 tool-result bug 修、ModelCallEndEvent 无变化、MiddlewareBase
加性 get_middleware_key)/ cheap 393+tier2 140+patch 20 测试全绿 / dev 两 venv
升级后 3 服务健康。收敛真跑:cheap 便宜档 ReAct 全链路 356 trace 零升级异常+
真出游戏过九门 9/9;tier2 Anthropic 工具循环跑满 40 轮写 15 文件 gen.log/trace
零升级异常(decision=fix 属 tier2 生成质量、非升级回归)。

2.0.3 新增原生 ReplyBudgetControlMiddleware(历史反复核验 2.0.2 不存在的类)/
tool 级洋葱/RAG/mem0,列而不迁(自建 ¥ 两段式 fail-closed 硬闸是护城河,原生
token 软控替不了),follow-up 见 §15。

Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
2026-07-06 02:06:14 -07:00

20 lines
2.4 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# tier2 · 富游戏自治生成线
这是绘境 AI 的第二条游戏生成线。它和现有的超休闲廉价线(`wg1/` + LittleJS)解耦并存、运行期零耦合:廉价线用便宜模型往声明式数据壳里填空、做单局几何色块小游戏;tier2 则给一个 AI agent 一台完整的游戏工作站——读文档、写多个 Phaser 源文件、构建、在真浏览器里真玩验收、看截图、查资产——让它在一圈确定性验收门的笼子里反复迭代,把现有产线做不出的多系统富游戏(合成、经营、挂机这类肥鹅美食街档)逼出来。
底座是 AgentScope 2.0.3(独立锁版、独立 env),引擎选 Phaser/Pixi(过无头硬筛、按 AI 作者视角取生态厚度)。生成范式是约束自治(O2):把一款游戏拆成数据表、系统骨架、表现层三层,用骨架和插件 API 锁住系统层最难的部分,把便宜模型的火力集中到必须写的约 56% 表现层,再用三层校验和四道熔断把自治关在笼子里。
整条线最深、也最没证过的赌注是:便宜或中等模型的自治 agent 能不能稳定写出那 56% 的表现层。所以建设按「顺序软、判据硬」走——先把集成和环境搭扎实,再用 M3(写代码逻辑)+ mmx(产美术音乐)连续迭代;但生成证据的判据保持离散可判定:M3 证路是软门、便宜档 n≥30 是硬门、退路树沿用数字触发线,只有硬门通过才投入重机器。
## 怎么读
- **要建什么、为什么**:`docs/brainstorms/2026-06-22-tier2-整体实现方案-requirements.md`(WHAT,已过双评审)。
- **怎么建(照这个动手)**:`docs/plans/2026-06-22-003-feat-tier2-富游戏自治生成线-plan.md`(HOW,10 单元,Phase A 详 / Phase B 纲要)。
- **接手须知**:`HANDOFF.md`(本次 6c6g 初始化交付了什么、Mac 接着做什么、环境切分)。
- **模块边界与红线**:`.agent`。
- **AgentScope 2.0.3 真实 API**:`.agents/knowledge/agentscope-2.0-facts.md`(拿不准先读 `/root/oss/agentscope` 源码 + agentscope-skill 的 `references/v2-*.md` 离线镜像;该 skill 的 SKILL.md 正文示例是 1.x,勿照抄)。
## 现状
2026-06-22 在 6c6g 完成项目初始化:模块骨架、独立依赖(`agentscope==2.0.2`)、governance、forbidden-import CI 就位。实现与运行调优转交 Mac / mini-desktop(真跑需 chrome/headless+esbuild,6c6g 禁 chrome)。