圣诞老人方法
多智能体对抗验证框架。列个清单,检查两遍。如果行为不端,就修正直到表现良好。
核心洞察:单个智能体审查自身输出时,会共享产生该输出的相同偏见、知识盲区和系统性错误。两个没有共享上下文的独立审查者可以打破这种故障模式。
何时激活
在以下情况调用此技能:
- 输出将被发布、部署或供最终用户使用
- 必须强制执行合规、监管或品牌约束
- 代码未经人工审查即投入生产
- 内容准确性至关重要(技术文档、教育材料、面向客户的文案)
- 大规模批量生成,抽检无法发现系统性模式
- 幻觉风险较高(声明、统计数据、API 参考、法律用语)
不要用于内部草稿、探索性研究或具有确定性验证的任务(这些请使用构建/测试/代码检查流水线)。
架构
┌─────────────┐
│ 生成器 │ 阶段 1:列出清单
│ (代理 A) │ 生成交付物
└──────┬───────┘
│ 输出
▼
┌──────────────────────────────┐
│ 双重独立审查 │ 阶段 2:复核两次
│ │
│ ┌───────────┐ ┌───────────┐ │ 两个代理,同一评分标准,
│ │ 审查者 B │ │ 审查者 C │ │ 无共享上下文
│ └─────┬─────┘ └─────┬─────┘ │
│ │ │ │
└────────┼──────────────┼───────┘
│ │
▼ ▼
┌──────────────────────────────┐
│ 裁决门 │ 阶段 3:判定好坏
│ │
│ B通过且C通过 → 好 │ 两者必须通过。
│ 否则 → 坏 │ 无例外。
└──────┬──────────────┬────────┘
│ │
好 坏
│ │
▼ ▼
[ 发布 ] ┌─────────────┐
│ 修复循环 │ 阶段 4:修复至通过
│ │
…