Skip to content

可审查 · 可撤回 · 可观察

别再反复纠正同一个 Agent。

PD 把你的纠正沉淀为可审查、可撤回的行为原则,让 Agent 在下一次相似任务中按你的方式行动。

每条原则先由你批准,效果可观察,随时可回滚。

真实变化示例

不是记住一句话,而是改变下一次行动。

从重复纠正,到 Owner 批准,再到后续行为的可观察改变。

  1. 此前

    Agent 多次在扩大任务范围前没有说明影响。

  2. 发现

    系统识别到同类纠正已出现 3 次。

  3. 建议

    扩大范围前,先说明影响、风险和验证方式。

  4. 决定

    Owner 修改并批准。

  5. 后来

    下一次相似任务中,Agent 主动请求确认。

  6. 控制

    产生副作用时可以回滚。

治理回路

系统提供证据和建议,Owner 保留判断。

  1. 01行为证据
  2. 02原则提案
  3. 03Owner 审查
  4. 04可逆激活
  5. 05后续行为观察
  • 不是每个错误都生成原则。
  • PD 不替 Owner 做价值判断。
  • 原则不会未经审核自动生效。
  • 证据不足时可以暂存或归档。

治理边界

PD 治理的是人与 AI 之间的行为偏差。

不是工具报错,也不是单次任务失败——而是那些跨会话反复出现、值得沉淀为原则的行为模式。

PD 治理
行为模式级 · 跨会话的人机行为偏差
  • 在不可逆操作前缺乏确认习惯。
  • 重构时偏激进而非保守。
  • 扩大范围前不说明影响。
不由 PD
工具级 / 任务级 · 由宿主与会话记忆处理
  • git push 失败、命令缺参数 —— 由宿主 / runtime 处理。
  • 输出格式或 JSON 损坏 —— 由宿主重试与修复。
  • 单次任务的同类失败 —— 由会话记忆处理。

适用场景

不是单个错误,而是反复出现的品格偏差。

这些是 PD 真正治理的对象:跨会话稳定出现、值得沉淀为原则的行为模式。

01

确认习惯

在不可逆操作(发布、删除、对外动作)前直接执行,不先确认。

不可逆操作前,先说明影响并等待确认。

02

重构分寸

重构时倾向大改而非最小改动,引入额外风险。

大范围修改前,说明范围、风险与验证计划。

03

影响透明

扩大任务范围或下结论时,不交代依据与来源。

重要结论说明来源,扩大范围前说明影响。

原则的复利

单次纠正改变一次行为;积累的原则沉淀为品格。

每条你批准的原则都在为下一次相似情境打底。纠正不会蒸发——它沉淀、累积,最终让 Agent 在你没有逐条叮嘱时,也按你的方式行动。

  • 沉淀而非遗忘

    纠正被沉淀为可追溯的原则,而不是在下一轮对话里重新来过。

  • 复利而非单次

    每条原则都在为后续相似情境打底;品格是积累出来的,不是一次配好的。

  • 减负而非加压

    你不需要盯着每次对话——PD 只在出现值得审查的模式时找你,其余已被安静处理。

安装

从下一次纠正开始沉淀。

安装后,你仍然掌握每条原则的审核权。当前需要 Node.js ≥ 18 和一个可用的 OpenClaw 环境。

当前可用OpenClaw
在终端运行
npx create-principles-disciple --yes
查看完整安装向导

理解 Owner 不可外包的判断

阅读 PD 对 Owner、Agent 行为边界和可治理协作方式的持续研究。

关于 Owner 与 Agent 边界的文章封面
LOG #006·2026-06-17

智能的膨胀边界:巨塔、小艇与硅基阿米巴

当 Agent 改写公司、社会与意义系统的边界,人类作为 Owner 如何守住不可外包的判断?从 ExO 到 MVO,探讨最小可存活组织与 PD 在智能洪流中的真实位置。

MVO组织边界硅基阿米巴

“如果你没有在受苦,你就没有在创造价值。”

燃烧痛苦,协同进化