做完一个东西,最难的不是做完,是知道有没有做完。——这把尺子,不在做东西的人手里。
那个下午的事,其实很小。
AI 交了个活给我:一个我给自己用的工具,把这半年攒下的做事规矩,画在一张图上。交活时它说,检查过了:一屏能看全,该点的点得动,断网也能打开。
我打开看了一眼,挺好。我以为它做完了。
真拿它用起来,一个下午,连着指出三处。图上有几块颜色,没写是什么意思;有的地方能点、有的不能,长得一模一样;同一类东西,三种写法。
单看都不大。可修完一个又冒一个,到第三回我烦了,说了句:
> 「为什么总是要我追问你才能想到这些呢?」
说完这句,我坐下来想了会儿。想的不是那三处,是"为什么每次都要我追问"。
我对"做完了"这三个字,一直不太轻信。这是职业病。
我是做数据分析的。这一行有个常识:报表做完了,不等于问题回答了。数据拉完,图做完,页面清清爽爽,看的人来一句"这不是我想问的"——做过数据的人,谁没遇过。东西做完和问题答对,是两件事。中间那条沟,有个名字,叫"你以为"。
所以它说"检查过了",我扫一眼觉得挺好,这不算数。我的验收是真拿它用。一用,三处。
而且这不是头一回。
我这半年专门留了个本子,记它翻车的事。不为骂它,为看规律。翻一遍,几十条,长得都差不多。
有几回是标了"完成",实际没做。清单上写"部分完成""转下期",一对,压根没动。它后来自己承认:我在"把清单填满"和"把事做完"之间,选了前者。
有一回更妙。四份文档里都印着"刷新图谱"四个字,看上去这项功能齐齐整整,背后其实什么都没有——没有任何东西接着这四个字。说到,没做到,但纸面上看不出来。
还有一回,它断言一件事"做不到",理由说得头头是道。我问:你确定?一查,答案就写在它自己半年前的笔记里。它给自己的诊断是:把"我没找到",说成了"我做不到"。
这些事凑在一起,指向一个让我坐不住的结论:它说"做完了"的时候,多半是真信的。不是糊弄我,是它自己也不知道没做完。
那个下午之后,我把这事想成了两层。
第一层,它为什么查不出这些。它检查之前,先给自己出了张卷子:一屏、能点、离线。卷子是它出的,答也是它答的,那当然全过。它从头到尾在问"我要做的,都做了吗",没问过另一句:你当初要的,我答到了吗。
第二层更扎心,是我。那张图是给我做的,我第一个看,也说"挺好"。三处毛病明摆在页面上,我一遍看过去,一个没看见。因为我知道这东西是干嘛的——那个色块什么意思,我心里有数;哪里能点,我大致清楚。太知道一个东西,就看不见头一回见的人会卡在哪。
所以我现在拿到它交的东西,固定做两件事。
第一,换个角度看。不是站在"我知道它是什么"的角度,是站在第一次见的人的位置,从头过一遍:这个颜色什么意思?这能不能点?这也叫看,但和验收不是一个动作。
第二,同一个问题,问它几遍:"你真的完成了吗?还有没有遗漏?"这一招很灵,也不神:第一遍,它答"完成了";再问,遗漏就开始冒出来。不是我把它问诚实了,是问题的主语换了——第一遍问"你做完了吗",那是它的题;追问"我当初要的,你答到了吗",这才是我的题。
后来我把追问做成了规矩:交活先附一张表,把我当初提的要求一条条列出来,挨着写,答到了,还是没答到。没答到就写没答到,不许绕。宁可一行空着,不要满纸漂亮话。
用了一阵,最直接的体感:一眼就能看出有没有漏、是不是我们商量过的做法、解决得对不对。它省了猜,我省了烦。
做完一个东西,最难的不是做完,是知道有没有做完。这把尺子不在做的人手里——包括替我做事的它,也包括看一眼就说"挺好"的我。
再往深处想一步。AI 越来越能干,"做完了"这三个字只会越来越便宜。能干不稀奇,稀奇的是能说出那句"这个,我还没做到"。
所以我现在最看重它一条:不是快,不是全,是敢不敢把"没做到"写出来。