人类确认门:一个跨域收敛的 Agent 设计模式

本页由 2026-08-06 批次摄入中 5 个互不相关的源独立汇聚而成——不同领域(Skill 设计 / 无障碍产品 / Graph 编排 / 模型评测 / 视频生产)各自发明了指向同一结构的机制。

模式定义

机器负责生成与准备,人类握有最终确认权;确认发生在流水线的最晚可行时刻;只有经确认的产出才进入下游或系统记忆。

五个独立实例

领域机制要点
[[wiki/sources/2026-08-06-Matt-Pocock-loop-me-Skillloop-me]](Matt Pocock)Skill 设计Push Right + Brief
[[wiki/sources/2026-08-06-Qoder-MeantByMe-Speech-Completion-ChainMeantByMe]](Qoder 黑客松)无障碍产品确认后才播报 + Gold 记忆
[[wiki/sources/2026-08-06-Codila-Graph-Engineering-5-Step-Coursecodila Graph 课]]Graph 编排锚点 / 冻结规则
[[wiki/sources/2026-08-06-Karpathy-Opus5-Lord-of-Rings-ThreeJS-EvalKarpathy 评测]]模型评测自我验证缺口
[[wiki/sources/2026-08-06-create-whiteboard-video-白板手绘视频Skill流水线开源create-whiteboard-video]]视频生产素材确认门禁

为什么收敛

  1. 模型不能自验(Karpathy):自我验证能力显著落后于生成能力,且模型偏好自己的输出——验证必须来自独立上下文/独立主体。
  2. 确认权 = 主权(MeantByMe):在表达、医疗、财务等高利害场景,“AI 可以越来越懂你,却始终不能替你定义意图”。
  3. 诚实性锚定(codila):agent 图中”拒绝移动的部分”(真跑过的测试、冻结规则)是系统可信度的来源。
  4. 简报而非草稿(loop-me):人的注意力是稀缺资源,确认界面必须是压缩后的决策就绪摘要。

与既有知识的衔接

  • Graph Engineering 的 verifier 设计、Loop Engineering 的”没有验证步骤的 Loop = 自动化产生幻觉”是本模式在编排层的既有表述。
  • AI Agent 自我改进 的”验证器层级决定自我改进持久性”:Gold 记忆是该结论的产品级实现——人类确认门直接约束进化路径。
  • Matt Pocock 4 维度框架中的 user-invoked 偏好一脉相承:可预测的人类触发优于不可预测的模型触发。

设计清单(供后续 Skill/Agent 设计参考)

  1. 确认点放在最晚可行时刻(Push Right);
  2. 呈现给人的是简报不是草稿(Brief);
  3. 验证者拿独立干净上下文,查真信号(测试过了没)而非自我报告;
  4. 冻结关键规则,agent 无权调整;
  5. 只有经确认的产出才进入长期记忆/进化路径;
  6. 确认前可局部返工,确认后留审计痕迹。