难题升级队列

让便宜模型先处理问题,只有在留下可追溯失败证据后才升级到 Fable 5 等重型模型的 Agent 成本控制模式。

简介

难题升级队列是《Claude 循环工具库:25 个让 AI 自动运转的 Loop 工作流》中第 21 个研究决策类工作流。它解决的是 Agentic Workflow 时代最常见的账单问题:很多问题其实便宜模型就能处理,却一开始就交给旗舰模型;而真正需要 Fable 5 这类重型模型的难题,又缺少清晰的升级条件,导致成本与价值脱钩。

这套模式的核心是“让问题挣得升级资格”。每个问题先进入队列,由便宜模型尝试回答或处理;如果成功,就不需要 Fable 介入;如果失败,必须记录失败证据、失败原因、已尝试路径和为什么需要升级。只有这份失败记录存在时,问题才能交给 Fable 5。这样既能避免为简单问题支付旗舰价格,又能让重型模型接手时站在前一轮失败之上,而不是重复踩坑。

难题升级队列不是简单的“先小后大”模型路由。它的关键在“记录下来的失败”。如果小模型只是随口说不会,或没有留下可检查输出,就不应该升级;如果升级到 Fable 后也无法解决,状态文件应记录新的失败证据,为下一轮人工判断、工具补充或流程调整提供依据。它把模型成本控制从预算口号变成了可审计流程。

关键信息

  • 类型:模型路由 / 成本控制 / Agent 工作流
  • 核心公式:便宜模型先试 → 写下失败证据 → 达到升级条件 → Fable 5 接手
  • 适用场景:研究问答、代码诊断、运营决策、复杂分析、长任务规划、客服升级
  • 关键文件:升级队列状态文件、失败记录、升级原因、最终裁决
  • 相关概念Fable 5状态文件Loop EngineeringGoal 提示语自我改进代理系统

核心特性

失败证据是升级门票

难题升级队列最重要的纪律是:没有失败证据,就没有升级。失败证据可以是错误输出、无法解释的指标异常、无法通过的测试、互相矛盾的检索结果、低置信度分类或小模型自评不足。但它必须具体到 Fable 接手时能读懂“之前为什么不够”。这避免了“感觉复杂所以用最贵模型”的成本浪费。

让 Fable 做真正需要 Fable 的事

这篇素材反复提醒 Fable 5 昂贵且不会自己停下,因此例行每轮应尽量用小模型,只有小模型失手的地方才让 Fable 出手。难题升级队列把 Fable 5 保留给跨来源综合、长期规划、复杂取舍、失败模式归纳和高价值判断,而不是让它处理普通分类、摘要、信息抽取或模板草拟。

与状态文件配合形成复利

每个升级案例都应写入状态文件:问题是什么,小模型尝试了什么,为什么失败,Fable 如何处理,最终是否成功,是否应形成新规则。时间久了,升级队列会暴露系统性问题:哪些类型问题总被小模型误判,哪些工具缺失导致升级,哪些提示词边界不清。此时队列不只是省钱工具,也变成改进 Agent 系统的诊断面板。

防止“自动升级滑坡”

如果升级条件过松,队列会退化成“所有问题最终都上 Fable”。因此应设置升级阈值:低成本尝试次数、失败类型、问题价值、风险颜色和预算上限。某些低价值问题即使小模型失败,也应返回“暂不升级”;某些红色风险动作即使 Fable 能做,也只能输出建议,不能自动执行。

不同素材中的观点

  • 2026-07-07-blocktempo-fable-loop-library-25-workflows:素材把“难题升级队列”列为 25 个工作流之一,并指出“为便宜模型就能回答的问题支付旗舰级价格,是 agent 账单爆炸最典型的方式”。这个队列要求每个问题先由便宜模型处理,只有在有一笔被记录下来的失败之后,Fable 才出手。文章在开头和结尾也反复强调便宜路由:例行轮次用小模型,便宜模型失手的地方才交给 Fable。

实用信息

推荐状态文件结构

# escalation-queue-STATE.md
 
## Queue policy
- 默认模型:小模型 / 低成本模型
- 升级模型:Fable 5
- 升级条件:必须有失败证据 + 问题价值超过阈值 + 不触碰红色自动化边界
 
## Pending questions
| id | 问题 | 价值/风险 | 小模型状态 | 是否可升级 | 原因 |
|----|------|-----------|------------|------------|------|
 
## Failed cheap attempts
| id | 小模型尝试 | 失败证据 | 已排除路径 | 建议升级原因 |
|----|------------|----------|------------|--------------|
 
## Fable decisions
| id | Fable 处理结果 | 是否解决 | 新规则/教训 | 是否写入 Skill |
|----|----------------|----------|-------------|---------------|

推荐 Prompt

你是难题升级队列管理员。
先用低成本模型处理队列中的每个问题。
如果低成本模型能给出可验证答案,记录结果并结束。
如果失败,必须写下:失败输出、失败原因、已尝试路径、为什么需要 Fable。
只有当失败证据充分、问题价值足够且不触碰红色自动化边界时,才升级给 Fable 5。
Fable 处理后,把最终结论、是否解决、应沉淀的新规则写回 escalation-queue-STATE.md。

适用判断

  • 问题量大,但只有少数真正复杂。
  • 任务成本差异明显,旗舰模型价格高。
  • 失败能被记录为证据,而不是纯主观“不满意”。
  • 系统需要长期观察哪些问题类型值得升级。

相关页面