确认习惯
在不可逆操作(发布、删除、对外动作)前直接执行,不先确认。
不可逆操作前,先说明影响并等待确认。
真实变化示例
从重复纠正,到 Owner 批准,再到后续行为的可观察改变。
Agent 多次在扩大任务范围前没有说明影响。
系统识别到同类纠正已出现 3 次。
扩大范围前,先说明影响、风险和验证方式。
Owner 修改并批准。
下一次相似任务中,Agent 主动请求确认。
产生副作用时可以回滚。
治理回路
治理边界
不是工具报错,也不是单次任务失败——而是那些跨会话反复出现、值得沉淀为原则的行为模式。
适用场景
这些是 PD 真正治理的对象:跨会话稳定出现、值得沉淀为原则的行为模式。
在不可逆操作(发布、删除、对外动作)前直接执行,不先确认。
不可逆操作前,先说明影响并等待确认。
重构时倾向大改而非最小改动,引入额外风险。
大范围修改前,说明范围、风险与验证计划。
扩大任务范围或下结论时,不交代依据与来源。
重要结论说明来源,扩大范围前说明影响。
原则的复利
每条你批准的原则都在为下一次相似情境打底。纠正不会蒸发——它沉淀、累积,最终让 Agent 在你没有逐条叮嘱时,也按你的方式行动。
纠正被沉淀为可追溯的原则,而不是在下一轮对话里重新来过。
每条原则都在为后续相似情境打底;品格是积累出来的,不是一次配好的。
你不需要盯着每次对话——PD 只在出现值得审查的模式时找你,其余已被安静处理。
安装
安装后,你仍然掌握每条原则的审核权。当前需要 Node.js ≥ 18 和一个可用的 OpenClaw 环境。
阅读 PD 对 Owner、Agent 行为边界和可治理协作方式的持续研究。

当 Agent 改写公司、社会与意义系统的边界,人类作为 Owner 如何守住不可外包的判断?从 ExO 到 MVO,探讨最小可存活组织与 PD 在智能洪流中的真实位置。
“如果你没有在受苦,你就没有在创造价值。”
燃烧痛苦,协同进化