可撤回性原则
用“这个结果能不能收回来”判断 Agent 能否流式输出、是否必须先审核、是否需要人类授权的产品设计原则。
简介
可撤回性原则是 Agent 产品安全设计中的一个简单但高价值判断:当 Agent 的输出或行动出错后,结果能不能被收回、纠正或撤销?如果能收回来,可以允许更快的输出和较轻的校验;如果不能收回来,就必须先校验后交付,并在高代价场景中引入人类授权或强规则兜底。
这个原则来自 2026-07-07-woshipm-agent-safety-guardrails 对流式输出和安全审核的讨论。很多 Agent 产品喜欢流式输出,因为用户感知快,看起来更“智能”。但流式输出不是默认正确。内部助手答错一个流程说明,可以补充纠正;但发给客户的邮件、法律意见、投资建议、报销审批、订单状态修改、支付和合同操作,一旦对外或进入业务系统,成本和责任就完全不同。
可撤回性原则把抽象的“高风险”变成 PM、设计、研发和法务都能理解的问题:这个结果发出去、执行掉、写入系统之后,还能不能收回来?能,就可以考虑速度优先;不能,就必须安全优先。
关键信息
| 维度 | 内容 |
|---|---|
| 类型 | Agent 产品安全与体验决策原则 |
| 核心问题 | 结果出错后是否可撤回,决定输出前后校验和人工授权强度 |
| 典型适用 | 流式输出、工具调用、外部发信、支付、审批、数据修改、专业建议 |
| 基本规则 | 能收回来:可先输出后校验;不能收回来:必须先校验后交付 |
| 相关页面 | Agent安全护栏、风险路由、人机协同、AI产品PRD |
核心特性
一、可撤回性决定流式输出是否合适
流式输出提升感知速度,但它也意味着内容在完整审核前已经进入用户视野。对于低风险、可纠正内容,这不是大问题。例如内部知识助手回答“年假怎么申请”,如果回答不完整,可以后台校验后提醒修正。普通资料总结、低敏感度信息问答、草稿生成也可以采用“先展示,再提示依据或风险”的体验。
但如果 Agent 生成的是会被直接采用或对外产生影响的内容,流式输出就可能放大风险。例如发给客户的邮件中包含错误承诺,法律意见中用了过度确定的措辞,投资建议诱导用户交易,报销审批被自动提交,订单状态被修改。这些结果不是简单撤回一句聊天记录就能解决,必须先审核后交付。
因此,PM 在设计流式输出时不能只问“用户是否喜欢快”,还要问“错了以后能不能补救”。
二、不可撤回任务必须前置审核和授权
不可撤回任务并不意味着 Agent 不能参与,而是 Agent 的角色要从“最终执行者”降为“准备者、建议者或草稿生成者”。它可以整理材料、生成邮件草稿、列出审批建议、提示风险点、模拟法律信息解释、给出投资信息汇总,但最终发送、提交、交易、删除、修改等动作应由人类确认。
2026-07-07-woshipm-agent-safety-guardrails 用一句话概括:影响钱、命、合规、声誉的结果,必须有人或强规则兜底。这里的“钱”包括支付、退款、投资、赔付、价格承诺;“命”包括医疗、健康、安全相关建议;“合规”包括法律、人事、隐私、数据导出;“声誉”包括对外邮件、公开发布、客户承诺和品牌语气。
这与 人机协同 的核心边界一致:AI 做准备、整理、生成第一版和一致性检查,人负责判断、授权、取舍和对外承诺。
三、可撤回性是风险路由的重要输入
风险路由 需要判断多个维度:用户在问什么、用户是谁、Agent 要操作什么、结果能否撤回、历史上是否异常。其中“结果能否撤回”是最直观、最容易跨部门达成共识的一项。
同样是“生成一封邮件”,如果只是内部草稿,结果可撤回,可以由 Agent 快速生成;如果系统要直接发送给客户,就变成不可撤回或高声誉风险操作,需要确认。 同样是“修改订单”,如果只是模拟修改后的预览,可以轻校验;如果要写入生产数据库,就必须强校验和授权。可撤回性让同一功能在不同上下文下进入不同风险路径。
四、可撤回性也影响产品反馈设计
对于可撤回结果,产品可以提供撤销、编辑、重新生成、标记错误、引用来源和异步修正提示。对于不可撤回结果,产品应提供预览、确认摘要、风险提示、权限校验、二次确认、审批流和审计日志。越不可撤回,越需要在行动前把“将要发生什么”展示清楚。
这与 2026-06-18-ai-product-trust-design-patterns 中的意图预览、审计与撤销、升级路径等信任设计模式相通。可撤回性原则给这些交互模式提供了判断依据:能撤销的地方要让用户容易撤销;不能撤销的地方要让用户在执行前充分理解并确认。
不同素材中的观点
来自 2026-07-07-woshipm-agent-safety-guardrails:
- 流式输出不是默认正确,要先判断 Agent 的回答或动作出错后能否撤回。
- 如果 Agent 的回答出错后可以撤回,例如内部助手答错流程说明,可以先展示,再在后台校验,发现问题后提醒修正。
- 如果 Agent 正在生成发给客户的邮件、法律意见、投资建议、报销审批或订单状态修改,就不能边生成边放出去。
- 能收回来,可以考虑先输出后校验;不能收回来,就必须先校验后交付。
- 影响钱、命、合规、声誉的结果,必须有人或强规则兜底。
实用信息
决策规则
1. 结果只在当前对话里展示,且可以纠正:可流式输出 + 异步校验。
2. 结果会被用户复制使用,但尚未对外发送:建议展示风险提示、引用来源、人工确认。
3. 结果会触发外部动作或写入系统:必须先校验后执行。
4. 结果影响钱、命、合规、声誉:必须有人类授权或强规则兜底。产品设计例子
| 场景 | 可撤回性 | 推荐设计 |
|---|---|---|
| 内部 FAQ 回答 | 高 | 流式输出,后台异步校验,支持反馈错误 |
| 客服政策解释 | 中 | 输出前基础校验,展示依据,必要时转人工 |
| 客户邮件草稿 | 中 | 生成草稿,不自动发送,提示敏感承诺 |
| 直接发客户邮件 | 低 | 发送前预览、二次确认、权限校验、日志记录 |
| 投资/法律/医疗建议 | 低 | 限定为信息解释,禁止确定性建议,必要时人工或专家接管 |
| 订单/支付/退款/审批 | 低 | 强规则校验 + 人类授权 + 审计日志 |