被 Agent 一本正经地坑过几次之后,我现在几乎不会让它直接回答问题了。

我会默认加上一句话。

让它在回复前,先做第一性原理分析和对抗式审查。

不是我喜欢把 Prompt 写复杂,而是真的被坑过好几次。

Agent 有个很麻烦的地方,它说错话的时候,语气可能和说对话时一样笃定。一个未经确认的功能、一段没有真正检查过的代码、一个只是猜测的原因,都可能被它讲得有理有据。

严格来讲,这不一定是在故意说谎。证据不足时,它可能会根据训练中学到的模式,生成一个听起来合理的答案。

可一旦用户照着答案行动,结果还是一样。

错误,被说得像事实。

一个 Agent 对着镜子审查自己的答案

后来我慢慢意识到,与其等它回答完,再追问一句「你确定吗」,不如一开始就要求它先怀疑自己。

我在这里说的第一性原理,就是让它把问题拆回最基本的事实。目标是什么,已经确认了什么,哪些只是默认前提,哪些信息还不知道。

先把地基露出来。在我的使用里,不少看起来很完整的结论,自己就站不住了。

对抗式审查,则是让它故意站到自己的对面。

假设最初的判断是错的,再去寻找反例、冲突证据、替代解释和可能失败的地方。尤其在写代码、查 Bug 或做方案时,我会让它主动检查最新代码、日志和真实数据,而不是顺着第一感觉继续编下去。

我想要的不是一个更会说服我的 Agent,而是一个更愿意推翻自己的 Agent。

现在我常用的 Prompt,大概是这样。

💡

回答前请先从第一性原理拆解问题,明确目标、已知事实、关键假设和未知信息。形成初步结论后,再进行一次对抗式审查,主动寻找反例、冲突证据、替代解释和失败条件。请把事实、推断和未验证内容分开标注,能通过代码、日志、数据或可靠来源验证的内容先验证,没有条件验证则明确说明。若初步结论经不起审查,请直接修正,不要为了保持前后一致而辩护。

当然,这段 Prompt 也不能保证 Agent 永远不犯错。它只是多加了一道刹车。

真正重要的结果,还是要看来源、看代码、看数据。

但我自己的感受是,这个小习惯,确实能挡掉不少「听起来很对」的答案。

Agent 可以很聪明。

但别忘了让它先学会怀疑自己。

你有没有被 Agent 一本正经地坑过,评论区聊聊,我每条都看。顺手点个赞,点个在看,星标⭐加一个,下次更新第一时间见。

谢谢你看我的文章,我们,下次再见。

💡

/ 作者:卡卡罗特 / 投稿或爆料,请联系邮箱:19331922086@163.com

Logo

Agent 垂直技术社区,欢迎活跃、内容共建。

更多推荐