Agent 研习舱
多 Agent 协作2026-04-12

验证子代理

定义

专门负责测试或验证主 Agent 工作成果的独立子代理,是多智能体系统中最一致有效的模式之一。其核心优势在于验证本质上只需最少的上下文传递,可以黑盒测试。

要点

  • 为何有效:验证不需要知道「为何这样构建」,只需判断「是否满足标准」→ 天然规避上下文污染
  • 输入三要素:待验证制品 + 明确成功标准 + 执行验证的工具
  • 主要失败模式:早期胜利问题(Early Victory Problem):跑 1-2 个测试通过后立即宣告成功
  • 防护措施
    • 明确要求「运行完整测试套件后才能标记通过」
    • 要求测试边缘情况和负向用例
    • 指令中明确写「You MUST run the complete test suite before marking as passed」
  • 最强大的模型(如 Opus 4.5)可以直接评估子代理工作,无需独立验证步骤;但对于能力较弱的编排者或需要强制验证检查点时,仍有价值

示例

软件开发场景:CodingAgent 实现功能 → VerificationAgent 运行测试套件 → 如失败附加失败信息重新触发 → 最多尝试 N 次。

相关概念

参考资料

  • 多智能体系统决策框架〔待补〕

被这些概念引用

来自本站知识库 · 全部概念