面向 Coding Agent 的证据核验与对抗复审机制

Agent 说:“完成了。”

你真的相信吗?Meaning Assurance(AI 对抗审计助手)把 Worker 的完成 主张、冻结证据、独立挑战、经过裁决的 Finding 与人类最终接受分离开来。

Agent 提出结果,证据接受核验,人类决定是否采纳。

它是一套协议,不是另一个 Agent

自信,不等于控制系统。

第二个 Agent 同意第一个 Agent,也可能只是“同步的自信”。协议要求在 人类接受结果前,让证据、质疑与重要分歧保持可检查。

01 / 约束

界定任务

记录范围、非目标、允许文件、测试要求与接受标准。

02 / 隔离

隔离实现

将 Worker 修改保存在 Git worktree,而不是直接写入源工作区。

03 / 冻结

冻结复审证据

为 Reviewer 收到的快照生成哈希,避免后续修改悄悄改变复审依据。

04 / 接受

保留人类权力

裁决 Finding 与分歧,但不允许 Agent 自己批准自己的工作。

检查完整裁决链

一条命令,一个有边界的决定。

确定性 Demo 使用合成 Fixture,不需要 API Key,不启动外部模型,只写入 由你指定的新输出目录。

$ powershell ... .\scripts\Run-Demo.ps1

Worker 主张:已完成
证据:一个声明测试没有运行
范围:一个修改文件越界
Finding:2 个确认 / 1 个驳回 / 1 个不可检验
人类决定:不接受

战略规划同样可以接受复审

展开头脑风暴,也保留反对意见。

第一方战略复审案例保存候选方向、对抗追问、Moderator 裁决与只读审计 记录。它证明流程可以复现,不构成市场验证,也不证明某项战略一定成功。

阅读有边界的案例
  • 第一方内部 Dogfooding,不是独立验证。
  • Git worktree 隔离文件,不隔离操作系统权限。
  • 冻结证据仍然可能不充分。
  • 协议不保证代码或决定正确。

委托工作,保留决定权。

不要只问 Agent 是否自信,检查它留下了什么。