核心 GUIDE

MENTAL_MODELFOUNDATION7 分钟阅读

Prompt、Context 与 Runtime Boundary

Prompt Wording、Supplied Context 与 Runtime Enforcement 解决的是不同问题。可靠 AI System 会把 Persuasion、Evidence 与 Capability Control 分开,而不是全部当成 Prompt Design。

核心心智模型

Prompt 决定模型如何理解并响应,Context 提供决策可用的信息,Runtime 决定哪些 Action 真正被允许与执行。可靠性要求三层彼此一致,但不能假装它们可以互相替代。

为什么重要

很多生产 Failure 来自“修错层”:用更强 Prompt 阻止危险 Tool Call、用更多 Retrieval 修 Permission Problem,或者用 Runtime Block 掩盖 Missing Context。清晰 Boundary 能让 Diagnosis 更快,也能避免把 Prompt Improvement 错当成 Hard Guarantee。

01

介入前先判断 Failure 属于哪一层

依次问三个问题:模型是否收到无歧义 Behavior Instruction?是否拿到做正确 Decision 所需 Evidence?Runtime 是否仍允许执行 Policy 本应禁止的 Action?Interpretation Failure 优化 Prompt,Evidence Failure 优化 Context,Enforcement Failure 则使用 Capability Gate、Schema 或 Approval。

02

示例:模型建议审批,但 Tool 仍能直接执行

Refund Assistant 已被 Prompt 要求 100 美元以上必须人工审批,并且模型正确输出“需要审批”。但 Tool Adapter 仍允许另一条执行路径直接调用 300 美元退款。Prompt Layer 已修好,系统依旧不安全,因为 Enforcement 属于 Runtime Boundary。

常见失败模式

  • 把 Prompt Language 当成 Irreversible Action 的唯一控制。
  • 真实问题是 Capability Enforcement 缺失,却继续添加 Context。
  • 本来只是上游 Ambiguity,却直接用 Hard Runtime Block 处理。

工程启发

  • 实现前先把每个 Intervention 分类为 Prompt、Context 或 Runtime。
  • Permission 与 Irreversible Side Effect 使用 Runtime Control。
  • 用 Evidence Trace 证明究竟是哪一层改变了 Outcome。

关键结论

  1. 01Prompt、Context 与 Runtime 是互补层,不是替代关系。
  2. 02Model Compliance 不等于 Capability Enforcement。
  3. 03正确识别 Failure Layer 可以避免昂贵但无效的修复。

阅读记录

未打开Practice 尚未完成

这里只记录你真实做过的动作,不代表掌握、熟练或认证。

用于这些学习路径

这个 Concept 会在多个 canonical 学习路径中复用。