lili 3947bcbe92 docs(cheap): 金标复验结论回填三品类 rubric 锚定履历(_note 注释性字段,条目文本零触碰)
rubric 挂点归一后真 LLM(M3)金标复验,三品类判据①正>反(品类分)/②同一正例品类路vs无品类路
通用分组小计漂移≤±1/③无 degraded:

- trpg:正例(_template-trpg 骨架)品类 5/5、合成黑箱点卡薄反 0/5·通用 0/11,与 merge 前基线
  (caadfe4c)吻合;判据②首采样 L2+2 超线→复采样 {1,0,0} 过线,定性=M3 judge 单次方差(同一
  prompt 无品类路两采样通用分即差 3;机制迁移零 prompt 漂移已机器逐字节证实,非迁移引入)。
- heritage(首次接线建基线):正例 _fewshot-feiyi 10/11(6/2/2)·品类 5/5 与 2026-07-02 死数据
  时代首评 anchors 逐值全同;薄反 _template-feiyi 6/11(4/0/2)·品类 4/5(+1 容差内)——接线零扰动。
- puzzle(首个真 LLM 复验):锚对失效实锤——_template-puzzle 黄金脚手架品类面已满(judge 判 5/5,
  逐条理由与源码核对全对得上:5 关维度递进/卡壳脉动提示/HUD 进度/结算历史最佳),不构成品类薄反;
  照各条 negative 面同构合成薄壳补验鉴别力(正 5/5 vs 合成 0/5·通用 0/11),_note 锚对口径修正。

复验证据 JSON(9+3 次评分全量 hits/why/tokens)留 scratchpad,不进仓库。33 测试绿。

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-03 00:18:46 -07:00
Description
No description provided
240 MiB
Languages
Java 38.3%
JavaScript 28.5%
Python 19.4%
Vue 6.2%
TypeScript 3.8%
Other 3.7%