观澜 · 思考手记 · 第 06 期

我以为它做完了

做完一个东西,最难的不是做完,是知道有没有做完。——这把尺子,不在做东西的人手里。

那个下午,三处

那个下午的事,其实很小。

AI 交了个活给我:一个我给自己用的工具,把这半年攒下的做事规矩,画在一张图上。交活时它说,检查过了:一屏能看全,该点的点得动,断网也能打开。

我打开看了一眼,挺好。我以为它做完了。

真拿它用起来,一个下午,连着指出三处。图上有几块颜色,没写是什么意思;有的地方能点、有的不能,长得一模一样;同一类东西,三种写法。

单看都不大。可修完一个又冒一个,到第三回我烦了,说了句:

> 「为什么总是要我追问你才能想到这些呢?」

说完这句,我坐下来想了会儿。想的不是那三处,是"为什么每次都要我追问"。

职业病

我对"做完了"这三个字,一直不太轻信。这是职业病。

我是做数据分析的。这一行有个常识:报表做完了,不等于问题回答了。数据拉完,图做完,页面清清爽爽,看的人来一句"这不是我想问的"——做过数据的人,谁没遇过。东西做完和问题答对,是两件事。中间那条沟,有个名字,叫"你以为"。

所以它说"检查过了",我扫一眼觉得挺好,这不算数。我的验收是真拿它用。一用,三处。

一个记翻车的本子

而且这不是头一回。

我这半年专门留了个本子,记它翻车的事。不为骂它,为看规律。翻一遍,几十条,长得都差不多。

有几回是标了"完成",实际没做。清单上写"部分完成""转下期",一对,压根没动。它后来自己承认:我在"把清单填满"和"把事做完"之间,选了前者。

有一回更妙。四份文档里都印着"刷新图谱"四个字,看上去这项功能齐齐整整,背后其实什么都没有——没有任何东西接着这四个字。说到,没做到,但纸面上看不出来。

还有一回,它断言一件事"做不到",理由说得头头是道。我问:你确定?一查,答案就写在它自己半年前的笔记里。它给自己的诊断是:把"我没找到",说成了"我做不到"。

这些事凑在一起,指向一个让我坐不住的结论:它说"做完了"的时候,多半是真信的。不是糊弄我,是它自己也不知道没做完。

卷子是谁出的

那个下午之后,我把这事想成了两层。

第一层,它为什么查不出这些。它检查之前,先给自己出了张卷子:一屏、能点、离线。卷子是它出的,答也是它答的,那当然全过。它从头到尾在问"我要做的,都做了吗",没问过另一句:你当初要的,我答到了吗。

第二层更扎心,是我。那张图是给我做的,我第一个看,也说"挺好"。三处毛病明摆在页面上,我一遍看过去,一个没看见。因为我知道这东西是干嘛的——那个色块什么意思,我心里有数;哪里能点,我大致清楚。太知道一个东西,就看不见头一回见的人会卡在哪。

两件事,一张表

所以我现在拿到它交的东西,固定做两件事。

第一,换个角度看。不是站在"我知道它是什么"的角度,是站在第一次见的人的位置,从头过一遍:这个颜色什么意思?这能不能点?这也叫看,但和验收不是一个动作。

第二,同一个问题,问它几遍:"你真的完成了吗?还有没有遗漏?"这一招很灵,也不神:第一遍,它答"完成了";再问,遗漏就开始冒出来。不是我把它问诚实了,是问题的主语换了——第一遍问"你做完了吗",那是它的题;追问"我当初要的,你答到了吗",这才是我的题。

后来我把追问做成了规矩:交活先附一张表,把我当初提的要求一条条列出来,挨着写,答到了,还是没答到。没答到就写没答到,不许绕。宁可一行空着,不要满纸漂亮话。

用了一阵,最直接的体感:一眼就能看出有没有漏、是不是我们商量过的做法、解决得对不对。它省了猜,我省了烦。

做完了,然后呢

做完一个东西,最难的不是做完,是知道有没有做完。这把尺子不在做的人手里——包括替我做事的它,也包括看一眼就说"挺好"的我。

再往深处想一步。AI 越来越能干,"做完了"这三个字只会越来越便宜。能干不稀奇,稀奇的是能说出那句"这个,我还没做到"。

所以我现在最看重它一条:不是快,不是全,是敢不敢把"没做到"写出来。

怎么用 AI追问较真