多 Agent 协作2026-03-28
GAN 式多 Agent 架构
定义
受 GAN(生成对抗网络)启发的多 Agent 设计模式:将生成与评估分离为独立 Agent,通过对抗性反馈循环驱动输出质量提升。
要点
- 核心洞察:模型自我评估倾向于过度乐观,分离评估者后调优其怀疑态度更加可控
- 评估者需要实际交互输出(如用 Playwright 操作页面),而非静态评分
- 评估标准需要将主观判断编码为具体可评分的维度(设计质量、原创性、工艺、功能性)
- 生成者在每次评估后做策略性决定:精细化 or 完全转向
示例
前端设计场景:Generator 生成 HTML/CSS/JS → Evaluator 用 Playwright 浏览并截图评分 → 反馈回 Generator → 5-15 次迭代。一个案例中,第 10 次迭代模型自发从平面布局转向 3D 空间体验。
相关概念
- Agent Harness
- 品味(Taste)〔待补〕 — 评估标准的设计本质上是"编码品味"
- Autoresearch — 同样依赖将质量标准形式化
- 长任务Agent Harness设计〔待补〕
- 验证子代理 — 生成-验证者模式的具体实现(验证者专门负责测试/评估)
参考资料
被这些概念引用
来自本站知识库 · 全部概念