核心 GUIDE
MENTAL_MODELFOUNDATION6 分钟阅读
模型声称 vs Runtime 事实
模型可以描述它认为发生了什么,但只有 Runtime 与外部系统能够确认真实发生了什么。
核心心智模型
模型文本只是 Observation 或 Hypothesis;Runtime State、Tool Response、数据库记录与真实 Side Effect 才属于证据层。
为什么重要
很多生产事故都从“把模型说的话升级成系统事实”开始。Agent 可能声称付款失败、文件已经保存或工具执行完成,即便 Runtime 只有模糊甚至相反的证据。系统必须明确区分 Narrated State 与 Verified State。
01
两个事实层
模型看到的世界是序列化后的视图:Prompt、Tool Output 与历史消息。真正的 Runtime 则拥有执行状态,并且可以读取持久化记录。当 Tool Timeout 或只返回部分信息时,模型可以形成推断,但这个推断不能在没有验证的情况下成为 Source of Truth。
02
例子:一次 Timeout 的退款请求
退款请求发生 Timeout。模型说“退款失败了”,于是重新发起请求。几分钟后,两次请求都结算成功,造成重复退款。正确的系统应先把 Timeout 视为 Unknown,再根据支付平台的权威状态完成 Reconciliation,之后才能决定是否 Retry。
常见失败模式
- 把 Assistant 的叙述直接保存成权威 Workflow State。
- 把缺失 Tool Output 理解成 Side Effect 没有发生。
- 让生成式摘要覆盖更强的 Source of Truth 数据。
工程启发
- 把执行事实与会话文本分开持久化。
- 把模糊结果明确建模为 UNKNOWN 或 PENDING。
- 使用权威外部标识符对 Side Effect 做 Reconciliation。
关键结论
- 01模型可以解释状态,但不应该天然拥有状态。
- 02Unknown 是一个合法而且常常更安全的 Runtime Outcome。
- 03权威事实应该流入模型,而不是由模型凭空生成。