diff --git a/tier2/config/generation.yaml b/tier2/config/generation.yaml index a0f1f59c..f8926aa4 100644 --- a/tier2/config/generation.yaml +++ b/tier2/config/generation.yaml @@ -25,8 +25,9 @@ model: default_model_name: MiniMax-M3 # 单写 agent 默认模型(M3 路;model_name_from_env 默认值) deepseek_flash: deepseek-v4-flash # 便宜主力档名(spike 主问「便宜到什么程度还守得住」) deepseek_pro: deepseek-v4-pro # 强便宜救场档名(退路树 Q1 读它的过门率) - baseline_opus: claude-opus-4-8 # 强基线 Opus(Anthropic 原生经 new-api;A 门「M3 证路(软)」主用,跑同一条 studio 线证「路本身通」) - baseline_fable: claude-fable-5 # 强基线 Fable(列出但不假设网关一定可用;build_baseline_model 取不到即诚实报错、不静默) + baseline_opus: claude-opus-4-8 # 强基线 Opus(网关现【无此渠道】、真调 503;待 new-api 开通后改这里即接上) + baseline_fable: claude-fable-5 # 强基线 Fable(同上,网关现无;列出不假设可用,build_baseline_model 取不到诚实报错) + baseline_crosscheck: deepseek-v4-pro # 跨族 cross-check(创始人 2026-06-24 拍:网关无 Opus/Fable,证路当前用它;实测可调) max_tokens: 16000 # 输出上限(非上下文窗;build_model 硬约束 max_tokens > thinking_budget) thinking_enable: true # M3 是否开 thinking 分离(便宜档无此约束,只 M3 路用) thinking_budget: 8000 # M3 thinking 预算(必须 < max_tokens,否则 build_model 抛) diff --git a/tier2/gen-worker/worker/config.py b/tier2/gen-worker/worker/config.py index 3ec2fe84..dfea6004 100644 --- a/tier2/gen-worker/worker/config.py +++ b/tier2/gen-worker/worker/config.py @@ -56,15 +56,26 @@ DEEPSEEK_PRO = genconfig.get("model", "deepseek_pro", "deepseek-v4-pro") # 强 # 若强基线都过不了门,说明是路/harness 的问题;若强基线能过、便宜档不过,才是便宜模型天花板(退路树 R3)。 # 两者都是 Anthropic 原生经 new-api(与 M3 同协议);Fable 列出但不假设网关一定可用(取不到诚实报错,见 build_baseline_model)。 # 退路树 fallback_tree.STRONG_BASELINE_KEYS 用 "Opus"/"Fable" 当聚合 key;这里的常量是它们在 new-api 上的真实模型名。 -BASELINE_OPUS = genconfig.get("model", "baseline_opus", "claude-opus-4-8") # 强基线 Opus(A 门主用) +# +# ⚠ 网关现实(2026-06-24 实测 + 创始人裁定):当前 new-api 网关只有 MiniMax + deepseek-v4-pro, +# 【没有 Opus/Fable/Claude/GPT】——build_baseline_model('Opus') 真调返 503 model_not_found。 +# 故「强模型证路」当前用 **deepseek-v4-pro 跨族 cross-check**(创始人 2026-06-24 拍:它不比 M3 明显强、 +# 证路力偏弱,但能跑、且 fallback_tree Q1 已引用它;真正的强模型证路待在 new-api 开 Opus/Fable 渠道后, +# 改 generation.yaml 的 baseline_opus/baseline_fable 即接上,代码已就绪)。deepseek-v4-pro 经实测 +# 在 new-api 上 Anthropic 原生路 + OpenAI 兼容路都可用;证路走 build_baseline_model(Anthropic 路) +# 以与 M3 同协议、同一条 studio/控制面线做 apples-to-apples 对照。 +BASELINE_OPUS = genconfig.get("model", "baseline_opus", "claude-opus-4-8") # 强基线 Opus(网关开通后用) BASELINE_FABLE = genconfig.get("model", "baseline_fable", "claude-fable-5") # 强基线 Fable(列出,不假设可用) +BASELINE_CROSSCHECK = genconfig.get("model", "baseline_crosscheck", "deepseek-v4-pro") # 跨族 cross-check(当前证路实际用) # 强基线聚合 key(fallback_tree 用)→ new-api 真实模型名 的映射。 -# build_baseline_model 接受「聚合 key(Opus/Fable,大小写不敏感)」或「真实模型名」两种入参: +# build_baseline_model 接受「聚合 key(opus/fable/crosscheck,大小写不敏感)」或「真实模型名」两种入参: # 传 key → 查本表换成真名;传真名 → 原样用(便于调用方直接点名网关上的具体模型)。 _BASELINE_NAME_BY_KEY = { "opus": BASELINE_OPUS, "fable": BASELINE_FABLE, + "crosscheck": BASELINE_CROSSCHECK, # 跨族对照(当前 = deepseek-v4-pro;网关无 Opus 时的证路主用) + "deepseek": BASELINE_CROSSCHECK, }