核心 GUIDE
Reversible Actions(可逆操作)
当系统优先提供可 Preview、Undo、Compensate 或分阶段 Commit 的操作时,Agent 即使做错决定,影响也更容易控制。
核心心智模型
Reversibility 是 Action Design 属性:只要业务允许,高后果 Side Effect 应该拥有明确的 Rollback、Compensation 或 Staged-commit 路径,而不是一步直接进入不可逆状态。
为什么重要
权限设计不只是在问 Agent 能不能调用某个 Tool。两个“允许”的操作可能 Blast Radius 完全不同:Draft 邮件与直接发送、准备退款与真正结算、创建 PR 与 Force-push Main。可逆的中间状态为 Verification 和 Human Control 留出了时间。
01
在 Commitment 前先 Stage 高后果效果
按 Reversibility 与 Consequence 给 Tool Action 分类。能用 Read、Preview、Draft、Soft Delete、Pending 或 Transaction-like Operation 时优先使用。真正不可逆的 Commit 应要求更强 Evidence 或 Approval;如果业务无法真正 Rollback,则预先定义 Compensation。Runtime 应明确知道哪一步跨过不可逆边界。
02
示例:Delete 改成 Quarantine
文档系统不直接给 Agent Permanent Delete,而是提供带保留期的 Quarantine。Agent 可以立即把错误文档移出 Active Retrieval,同时 Operator 仍能查看 Provenance 并恢复。Permanent Deletion 则作为独立、可审计的 Transition 处理。
常见失败模式
- 一个宽泛 Tool 同时包含 Preview 和不可逆 Commit 能力。
- 把操作称为可逆,却没有评估 Rollback 本身的信息损失或外部影响。
- 事故发生以后才让人工临时设计 Compensation。
工程启发
- 自主执行优先选择 Staged 与 Compensatable Operation。
- 在 Tool Contract 和 UI 中显式标出不可逆 Transition。
- 扩大 Agent Authority 前先测试 Rollback 或 Compensation Path。
关键结论
- 01Reversibility 会降低错误决策成本。
- 02Permission Scope 应反映 Consequence,而不只是 API Surface。
- 03Staged Commitment 为 Verification 与 Human Review 留出空间。
阅读记录
这里只记录你真实做过的动作,不代表掌握、熟练或认证。
用于这些学习路径
这个 Concept 会在多个 canonical 学习路径中复用。
来自 Knowledge Graph 的相关知识点
这些关系直接来自 canonical graph,不维护第二套 Guide 分类体系。