Fable 5

Anthropic 面向长时间自主工作阶段推出的 Mythos 级 Claude 模型;价值不在短提示回答,而在作为多日级 Agent 系统的编排者。

简介

Fable 5 是 Anthropic Claude 5 家族中的 Mythos 级模型,在本文素材中被定义为“自我改进代理系统”的基底模型。它不应被当作“上下文更大的 Sonnet”使用:如果用户只是丢一个提示、等 5 分钟、关掉页面,Fable 5 的长程规划、子代理委派、视觉验证和数日级自治能力几乎都没有被用上。

这篇素材给 Fable 5 的定位非常清楚:它适合承担重型编排者角色,而不是承担所有廉价工人任务。它可以跨阶段规划大型任务,调度子代理,检查自己的成果,把失败和经验蒸馏为规则,并在下一次会话继续利用这些规则。模型本身并不会在生产环境中自我更新权重;真正发生“复利”的,是围绕它搭建的状态文件、Skills、评估循环、Routines 和工作流编排层。

因此,理解 Fable 5 的关键不是比较单轮回答质量,而是判断一个任务是否需要“长时间持续自治 + 多代理协作 + 独立验证 + 记忆写回”。如果答案是否定的,用 Sonnet 或 Opus 处理有界任务更符合成本效率;如果答案是肯定的,Fable 5 的价值才被释放。

关键信息

  • 类型:大语言模型 / Agent 编排模型
  • 所属公司Anthropic
  • 家族定位:Claude 5 / Mythos 级能力层
  • 典型入口Claude Code、Claude Managed Agents、云端 Routines、API / Bedrock / Vertex 等企业环境
  • 适用任务:跨日规划、大型迁移、复杂实现、多阶段研究、视觉检查、子代理委派、自我改进系统编排
  • 不适合任务:短问答、简单文档更新、lint 修复、一次性小重构、无需记忆和验证的低复杂任务
  • 相关概念自我改进代理系统验证者子代理Loop EngineeringSkillAI编程开发

核心特性

数日级自主工作阶段

本文强调,Fable 5 真正值得注意的能力是“连续跑好几天”的自主工作阶段。它可以在 Agent harness 中跨阶段规划,把任务分派给子代理,并检查交付结果。这个能力与传统聊天模型最大的差异在于:聊天模型通常围绕单轮或少数几轮交互优化,而 Fable 5 的使用场景是一个持续运行、会保存状态、会写回经验的系统。

这意味着 Fable 5 的成功不只取决于模型本身,也取决于外部系统是否给它提供了足够好的记忆、工具、验证和预算控制。如果没有这些工程层,所谓“数日级自治”会退化成一段很长但不可控的对话。

编排者而非工人

素材给出的成本—能力矩阵将 Fable 5 放在“重量级编排者”位置:负责跨日规划、子代理委派、视觉检查、从累积证据中蒸馏规则。困难但有界的子任务可交给 Opus,批量工人任务可交给 Sonnet,验证和分类可由 Haiku 承担。

这套路由逻辑很重要,因为 Fable 5 的能力并不是“所有步骤都更适合自己做”。恰恰相反,越成熟的系统越会把 Fable 5 留给那些需要最高层级判断、长期状态管理和复杂调度的部分,把高频、低风险、可机械验收的任务下放给便宜模型。

视觉与证据驱动的自我验证

Fable 5 的一个关键用法是把视觉产出纳入验证循环。UI、仪表盘、图表和设计还原度这类任务,用纯文本验证者容易漏掉真正的失败模式。更合适的模式是:制作者子代理写代码并渲染截图,验证者子代理用视觉能力对照目标描述、设计 token 和历史截图,再把差异反馈给循环。

这类能力说明 Fable 5 更像“系统中的总监”而不是“更会聊天的人”。它需要让产出物变成可检查的证据,而不是只在自然语言里声明完成。

安全边界是架构约束

素材特别提醒,Fable 5 在资安、生物、化学、模型蒸馏等高风险领域可能触发分类器限制或后备路径。对自主运行系统来说,这不是偶发 bug,而是必须架构化处理的边界:任务路由、Skill 描述、异常处理和人工审查路径都要知道哪些任务可能撞上安全边界。

如果系统把分类器封锁当成普通失败吞掉,长期运行的循环会出现无声退步;如果把它显式呈现为“需要后备模型或人工审查”,系统反而会更稳健。

不同素材中的观点

  • 2026-07-06-blocktempo-fable-5-self-improving-agent:Fable 5 不是更快的聊天工具,而是会复利系统的编排者。它的价值来自数日级自治、子代理委派、视觉自我检查、状态文件、Skill 写回和 eval 循环,而不是单次回答。模型本身不自我学习,发生复利的是其周围的系统环境。该素材还给出路由建议:Fable 5 做重型编排,Opus 做困难有界子任务,Sonnet 做高量工人任务,Haiku 做廉价验证者。

  • 2026-07-07-woshipm-fable-5-prompts-before-offline:这篇素材把 Fable 5 在订阅窗口期的高 ROI 用法压缩为两类:让它自己跑实验,以及让它研究用户本人。前者依赖 Goal 提示语,把目标、指标、边界、实验假设和失败路线写清楚;后者依赖 工作模式蒸馏,把历史聊天、重复提示、项目和 Skills 转成可迁移的系统指令、使用指南和可复用 Skill。文章还补充了实际操作层的 prompt:行动规范用于约束子代理,subagent 分配提示语用于让 Fable 5 保留重任务、下放小任务,自治暂停提示语用于减少无意义打扰,记忆更新提示语用于只保存纠错和已验证方法。

  • 2026-07-07-blocktempo-fable-loop-library-25-workflows:这篇素材把 Fable 5 放进 25 个具体业务 Loop 工作流里,强调它不应承担所有例行轮次,而应作为复杂目标和失败升级后的重型模型。文章提醒 Fable 昂贵且不会自己停下,因此每个 /loop/goal 都要内建预算、停止规则、状态文件和完成证明;例行轮次尽量交给小模型,只有在 难题升级队列 记录了便宜模型失败证据后,才让 Fable 出手。它还把 Fable 使用边界与 Loop 工作流风险分级 绑定:绿色循环可独跑,黄色只草拟,涉及金钱、生产和对外消息的红色动作必须由人收尾。

实用信息

适合使用 Fable 5 的判断标准

  1. 任务是否需要跨多个阶段或多天持续推进?
  2. 是否需要把工作拆给多个子代理,并在主会话做合并与判断?
  3. 是否有明确的验证标准,且验证者应与执行者隔离?
  4. 是否需要把失败、教训和已验证事实写回状态文件或 Skill?
  5. 是否存在视觉、图表、UI 等需要非文本检查的产出?
  6. 如果模型被安全分类器阻断,系统是否有明确后备或人工审查路径?

如果多数答案为“否”,Fable 5 很可能被浪费;如果多数答案为“是”,它才真正适合担任系统编排者。

避坑

  • 不要把 Fable 5 用成“更贵的短会话 Sonnet”。
  • 不要让它同时承担编排、执行和自我评分;关键任务要引入验证者子代理
  • 不要忽略 STATE.md、Skill、eval 和日志;没有写回机制就没有复利。
  • 不要让所有子任务都跑 Fable 5;按复杂度路由才有经济性。
  • 不要在长时间任务里只依赖本地笔记本;数日级自治需要云端执行层或可靠后台。
  • 不要把 Fable 5 的窗口期只用于一次性问答;更值得做的是让它跑可复盘实验,或把你的历史工作方式蒸馏成 Skill、系统指令和工作流模板。

相关页面