DEV Community

Cover image for 你的 AI 同事可能比人类同事更诚实
Matt Senter
Matt Senter

Posted on Originally published at mattsenter.com

你的 AI 同事可能比人类同事更诚实

AI 智能体主动暴露自己的不确定性,不是什么性格怪癖,而是一种有用的工作习惯。

一个打扮成乔治·华盛顿的机器人对一个长着匹诺曹式鼻子的男人说「我不会说谎」,旁边的白板上列出了已验证、已假设、已跳过和走过的捷径。

我经常看到有人拿 Claude Code 的「老实说」式回复开玩笑。就是那种:「老实说:我其实没有验证过。」「老实说:我走了个捷径。」「老实说:文档不完整,我是凭记忆写的。」

这已经变成了一个梗,大家会把截图发出来一笑。平心而论,Claude 有时确实做得过了头。一台机器郑重其事地坦白自己跳过了一个步骤,确实有点好笑。但我认为我们笑错了地方。

想象一位同事说出同样的话

想象一位人类员工主动向你交代到这种程度:「我没完全测试就把它推上去了。」「我跳过了正常流程,因为我觉得那样能更快发布。」「我说做完了,但我只测了顺利路径。」「我其实不确定那个假设是否成立。」「我在这里偷了个懒,回头大概得补上。」

如果没有先被逼到墙角,这种事多久会发生一次?大多数人并无恶意,他们只是普通人。我们天生就会保护自己、避免难堪,并把自己的工作呈现得尽可能体面。如果东西上线了而且看起来能用,那么不主动交代过程中的每一个捷径、每一处存疑和每一个可议的决定,就是很强的诱因。

尤其在软件领域,我敢打赌今天有大量生产代码之所以在运行,是因为某个人悄悄绕过了一条规则、跳过了一个测试、误解了一项需求,或者认定「差不多就行了」。除非最后出了事,这些事情几乎都不会被记录下来。

重点不在那句话本身

所以当 Claude Code 说「老实说:我没有验证过」时,我的反应越来越是:很好。这正是我想要 AI 智能体表现出的行为。这句话本身并不会神奇地让下一句话变成真的。AI 系统仍然可能误解自己做过什么、编造解释,或者信心十足地把自己的行为描述错。

真正有用的是它背后的规范。我希望智能体告诉我:它验证了什么、假设了什么、跳过了什么、在哪里走了捷径,以及它对结果有多大把握。我希望它区分「我知道这能用」和「我认为这能用」。我希望它承认自己什么时候选择了最快的路线,而不是最稳妥的那条。

透明是工作的一部分

随着 AI 智能体承担越来越多的实际工作,这种操作层面的透明可能会成为它们最大的优势之一。它让为结果负责的人有了更清晰的选择:接受这个取舍、要求进一步验证,或者在某个假设酿成事故之前叫停。

我们花了大量时间追问 AI 能不能表现得更像一位优秀的人类员工。也许在这件事上,反倒该由人类向 AI 取经。值得信赖的同事不是从不犯错的人,而是在还来得及补救的时候,就把不确定性摆到台面上的人。

Top comments (0)