Agent 研习舱
多 Agent 协作2026-03-28

GAN 式多 Agent 架构

定义

受 GAN(生成对抗网络)启发的多 Agent 设计模式:将生成评估分离为独立 Agent,通过对抗性反馈循环驱动输出质量提升。

要点

  • 核心洞察:模型自我评估倾向于过度乐观,分离评估者后调优其怀疑态度更加可控
  • 评估者需要实际交互输出(如用 Playwright 操作页面),而非静态评分
  • 评估标准需要将主观判断编码为具体可评分的维度(设计质量、原创性、工艺、功能性)
  • 生成者在每次评估后做策略性决定:精细化 or 完全转向

示例

前端设计场景:Generator 生成 HTML/CSS/JS → Evaluator 用 Playwright 浏览并截图评分 → 反馈回 Generator → 5-15 次迭代。一个案例中,第 10 次迭代模型自发从平面布局转向 3D 空间体验。

相关概念

  • Agent Harness
  • 品味(Taste)〔待补〕 — 评估标准的设计本质上是"编码品味"
  • Autoresearch — 同样依赖将质量标准形式化
  • 长任务Agent Harness设计〔待补〕
  • 验证子代理 — 生成-验证者模式的具体实现(验证者专门负责测试/评估)

参考资料

被这些概念引用

来自本站知识库 · 全部概念