框架: compact恢复锚点——三线并行(升格6本批量/正文智能体验证消费闭环run3/范式线待启)+卡是索引两条线设计结论

This commit is contained in:
zizi 2026-07-19 02:12:11 +08:00
parent 11bdbbd5a2
commit 1a3204827d

View File

@ -117,3 +117,31 @@
## 额度阀提额(2026-07-18,创始人拍板) ## 额度阀提额(2026-07-18,创始人拍板)
MiniMax 每 5h 窗自限从 **$10/4000 次 → $24/6000 次**(改 `llm.py` 常量 WINDOW_BUDGET_USD=24.0 / WINDOW_CALL_CAP=6000)。机制不变(撞 $24 自动降级便宜模型、撞 6000 次自动挂窗续跑),仅抬高每窗吞吐上限。**注意**:此为 llm.py 独立于 New-API 服务端的本地自限阀,已运行进程需重启才生效(模块常量启动即载入)。上文所有 "$10/4000" 表述为提额前的历史记录,现行值以此条为准。 MiniMax 每 5h 窗自限从 **$10/4000 次 → $24/6000 次**(改 `llm.py` 常量 WINDOW_BUDGET_USD=24.0 / WINDOW_CALL_CAP=6000)。机制不变(撞 $24 自动降级便宜模型、撞 6000 次自动挂窗续跑),仅抬高每窗吞吐上限。**注意**:此为 llm.py 独立于 New-API 服务端的本地自限阀,已运行进程需重启才生效(模块常量启动即载入)。上文所有 "$10/4000" 表述为提额前的历史记录,现行值以此条为准。
---
## Compact 恢复锚点(2026-07-19,三线并行进行中)
compact 只清主代理上下文、不动磁盘与后台进程。恢复后从这里接。当前三条线并行:
### 线1:升格批量抽取(6本,task#17,进行中)
- **背景**:机动4/深空8 已收官(前文);剩 6 本首次做升格——机战10/机破7/机武6/星环3/超神11/希泊尼2,均已建窗(976窗),4条并发跑道:A=[10]、B=[7→6]、C=[3→11]、D=[2],命令 `parse_upgrade.py run --work-id N --semantic-dedup`(无max-calls,靠额度自停),nohup 脱离会话。
- **恢复查状态**:`.venv/bin/python /tmp/upg_dashboard.py`(已打补丁:跑道链排队本不再误判STOPPED)。进度快照(compact时):机战71/机破72/星环59/希泊尼53、机武0/超神1(后两者排队)。
- **监控**:定时cron `b2c3518a`(13,47分)自动巡检+处置(int/str真bug→修;敏感/网络→续跑;**429/403账户额度→先探测chat_governed恢复没→恢复即续跑所有停本,连3轮不恢复才呈报**;全完成→质量验收)。cron是会话级、compact不杀;若恢复后cron没了则重建(提示词见git log该cron创建处)。
- **坑(已踩)**:①New-API账户有**独立Token Plan积分池**、和llm.py的$24/6000自限是两回事,积分耗尽会429→全模型403(**可恢复,非硬故障**,部分渠道耗尽);②出场章int/str混排bug已修(提交8e9e97c);③断点续跑靠failed窗自动撤销重跑,杀进程不丢数据。重跑准备脚本`reset_upgrade_work.py`。
- **额度**:llm.py自限已提到 $24/6000/5h窗(提交11bdbbd,创始人拍板)。
- **全完成后**:质量验收(卡数/成长线/登场/向量/零failed)+ embed补关系卡向量 + 落档 + 呈报。
### 线2:正文智能体验证=消费闭环第1层(task#16,进行中,创始人深度参与设计)
- **大目标**:验证"卡到底帮不帮生成"。**自底向上建三层智能体**(创始人定序):①正文智能体→②细纲智能体→③大纲+设定智能体。每层用参考书当标准答案、在已验的下层输入上验。
- **已跑两轮**:run1(固定喂7卡+只给上一章,两臂都被喂残→**无效**);run2(两臂都能自主探索≤488历史正文、有卡臂+卡检索,/tmp/eval2_gen_*.md)→评委盲评 **无卡23 : 有卡20,卡没帮反拖后腿**:卡在核心硬设定(加特朗代际/核雷发射/卡依斯术语)带偏、文风更远,只堆了装饰性周边世界观;机制=**卡挤掉了读原文**(有卡臂读18次工具 vs 无卡29次)。
- **创始人关键判断(重要设计结论)**:**卡是索引、不是原文替代品;写作要两条线=卡检索(谁/什么/哪找)+原文检索(怎么说/什么质感)协同,卡指到原文不替原文**。另:①正文腰斩是主代理的错——原书489=7051汉字,两稿只~4000(我给的细纲cap成4000-5000)→缺叙事张力;②应照细纲执行、需**审查智能体**;③加特朗无卡是因**全书仅489一章出场**、按"单章龙套只留档不立卡"门槛漏掉——揭示"卡门槛是出场跨章数、非叙事重要度"的缺陷,正向创作时设定层应主动给关键一次性角色立卡。
- **run3(进行中)**:按上述重搭两写手(opus,agentId 有卡ae67300c/无卡a2c95442),三处修复:**篇幅对齐~7000汉字不腰斩、卡当索引查到后强制顺章号回读原文、通读485-488四章**。产出 `/tmp/eval3_gen_{有卡,无卡}.md`(compact时尚未出)。
- **run3待办(恢复后接)**:写手出稿→派**审查智能体**逐条核细纲(伏笔/事件/实体设定矛盾)→有问题打回改→派**评委**6维盲评(设定一致/实体保真/要素覆盖/情节忠实/文风一致/文笔)对原书489。评委+审查走opus(Claude通道,**不占MiniMax抽取额度**)。
- **工具(冻结护栏≤488,已自测)**:`/tmp/eval_tools/eval_prose.py`(search/get正文,489+硬拦)、`/tmp/eval_tools/eval_cards.py`(by-name/search卡,只出6类实体卡冻结视图、排除关系卡)。标准答案`/tmp/eval_answer_489.md`;两稿副本`docs/eval-正文489/`(创始人可读)。
- **诚实保留**:n=1不下结论;须多样本(5-10章×2-3本×场景类型)+修注入(正经当前态视图非冻结历史)+控挤出(纯原文/纯卡/卡+原文三臂)+内容感知冻结(防事件卡窗口错位泄露,已抓一例:489反转被标488)+多评委。run3先把489修对拿站得住的单点对照,再决定上多样本大版。
### 线3:范式线(task#18,待启)
- 3本缺范式(希泊尼2/机武6/机破7)+超神11补8章(窗51-58的cards)。子代理研究已出**完整runbook**(续跑安全/并发安全/走同一chat_governed额度):一本一路 `parse_llm.py chapters→parse_outline.py window→parse_llm.py cards→check`,顺序不可乱、每步断点续跑。超神补:`parse_llm.py cards --work-id 11 --from-order 51` + `--from-order 57`。~7500次调用。**待升格跑道空出后启动**(共享额度,总并发控~6-8)。
**恢复后第一步**:跑dashboard看升格进度;查`ls /tmp/eval3_gen_*.md`看写手出稿没——出了就接run3待办(审查→judge),没出就等通知。不擅自跑烧MiniMax额度的管线。