核心 GUIDE

MENTAL_MODELINTERMEDIATE6 分钟阅读

Reversible Actions(可逆操作)

当系统优先提供可 Preview、Undo、Compensate 或分阶段 Commit 的操作时,Agent 即使做错决定,影响也更容易控制。

核心心智模型

Reversibility 是 Action Design 属性:只要业务允许,高后果 Side Effect 应该拥有明确的 Rollback、Compensation 或 Staged-commit 路径,而不是一步直接进入不可逆状态。

为什么重要

权限设计不只是在问 Agent 能不能调用某个 Tool。两个“允许”的操作可能 Blast Radius 完全不同:Draft 邮件与直接发送、准备退款与真正结算、创建 PR 与 Force-push Main。可逆的中间状态为 Verification 和 Human Control 留出了时间。

01

在 Commitment 前先 Stage 高后果效果

按 Reversibility 与 Consequence 给 Tool Action 分类。能用 Read、Preview、Draft、Soft Delete、Pending 或 Transaction-like Operation 时优先使用。真正不可逆的 Commit 应要求更强 Evidence 或 Approval;如果业务无法真正 Rollback,则预先定义 Compensation。Runtime 应明确知道哪一步跨过不可逆边界。

02

示例:Delete 改成 Quarantine

文档系统不直接给 Agent Permanent Delete,而是提供带保留期的 Quarantine。Agent 可以立即把错误文档移出 Active Retrieval,同时 Operator 仍能查看 Provenance 并恢复。Permanent Deletion 则作为独立、可审计的 Transition 处理。

常见失败模式

  • 一个宽泛 Tool 同时包含 Preview 和不可逆 Commit 能力。
  • 把操作称为可逆,却没有评估 Rollback 本身的信息损失或外部影响。
  • 事故发生以后才让人工临时设计 Compensation。

工程启发

  • 自主执行优先选择 Staged 与 Compensatable Operation。
  • 在 Tool Contract 和 UI 中显式标出不可逆 Transition。
  • 扩大 Agent Authority 前先测试 Rollback 或 Compensation Path。

关键结论

  1. 01Reversibility 会降低错误决策成本。
  2. 02Permission Scope 应反映 Consequence,而不只是 API Surface。
  3. 03Staged Commitment 为 Verification 与 Human Review 留出空间。

阅读记录

未打开Practice 尚未完成

这里只记录你真实做过的动作,不代表掌握、熟练或认证。

用于这些学习路径

这个 Concept 会在多个 canonical 学习路径中复用。

来自 Knowledge Graph 的相关知识点

这些关系直接来自 canonical graph,不维护第二套 Guide 分类体系。