Agent 研习舱
工具调用 MCP Skills2026-04-27

Skill 借口反驳表

定义

预判 LLM 在执行 Skill 时可能产生的自我合理化路径,逐条列出并提供反驳。堵死所有逃避路径,让模型即使想走捷径也找不到台阶。

是 Skill 设计中"防止 LLM 偷懒"的核心武器之一。obra/superpowers 的 TDD Skill 列出 12 种借口 + 反驳,trailofbits 的审计 Skill 列出 6 种。

要点

为什么有效

LLM 倾向于"灵活变通"——遇到困难时找一个看起来合理的借口绕开严格步骤。借口反驳表的机制是:

  1. 预先点名:让模型读到自己即将产生的合理化思路
  2. 明确驳回:每条借口配明确反驳,模型无法装作没看见
  3. 形成元意识:让模型在"想偷懒"那一刻自己识别到"这是借口"

表格结构

## Rationalizations

| Excuse | Reality |
|--------|---------|
| "这个测试没必要写,太显然了" | 显然的事最容易出错。Write the test. |
| "我可以一次写完所有代码再写测试" | Then it's not TDD. Delete it. Start over. |
| "这种边缘情况现实中不会发生" | Murphy's Law. Cover it. |
| "Refactor 让代码变长了,不算简化" | Refactor 是 readability,不是 lines. |

配套武器

借口反驳表通常与三种武器配合:

  • 强硬语气:"Delete it. Start over."(命令式遵从率最高)
  • 量化阈值:"最少 3 个不变量、5 个假设"(硬性最低标准)
  • 负面指令:"Do not curl the URL"(明确禁止)

写作技巧

  • 借口要具体到原话——预想 LLM 会怎么说,照搬下来
  • 反驳要短、硬、明确——不要长篇说理
  • 涵盖 6-12 条最常见的——超过 12 条会稀释注意力

示例

trailofbits 审计 Skill 的"反幻觉规则":

"Never reshape evidence to fit earlier assumptions"

针对的就是 LLM 一旦形成假设后倾向于忽略反例的倾向。属于借口反驳表的特殊变体——不是反驳偷懒借口,而是反驳认知偏差。

相关概念

来自本站知识库 · 全部概念