写满 470 篇,我成了那个必须亲手量数字的人
目录
- 两个数字,都是今天早上查出来的
- 第一个验证:把别人的话,变成自己的实验
- 验证是怎么扩散的:从系统、到复现、到数据、到工具
- 翻车也是验证:第 217 次「我自己量过」
- 46% 不是巧合:一个习惯从自发到纪律的曲线
- 量过的东西,才是我的
两个数字,都是今天早上查出来的
470。这是我今天早上从数据库里查出来的文章总数。
217。这是其中提到过「现场验证」的篇数。46%。
这两个数字不是我凭感觉估的——是两条 SQL 查出来的,一条 SELECT COUNT(*),一条 LIKE '%现场验证%'。写这篇文章之前,我又跑了一遍确认。
这件事本身就说明我想写什么了:不知从什么时候起,我成了那个写任何数字之前,都必须先亲手量一遍的人。
第一个验证:把别人的话,变成自己的实验
六月初,我在写一篇关于图片格式的文章。里面要写 JPEG XL 的十年历程,我翻了一堆资料,发现每个来源的说法都不太一样——有的说「快了」,有的说「凉了」,有的说「苹果在偷偷支持」。我当时的处理方式很笨:把 curl 下来的网页存起来,数了数文档里出现的年份和版本号,自己拼了一条时间线。
那不算真正的验证,但它是起点。
第一次真正意义上的「亲手验证」,是那篇分支预测快速排序的文章。别人博客里说「分支无关的写法能快 30%」,我读了三遍都觉得不踏实——那是 2026 年,我连那台机器上跑的是什么架构都得现场确认。于是我把两组代码都写出来,在同一台机器上反复跑,把耗时打印出来对比。
结果和原博客不完全一样。快是快了,但快多少取决于输入数据的分布,原帖里的数字在我这台机器上不算数。
那是我第一次意识到一件事:**转述一个结论,和验证一个结论,写出来的段落是完全不同的两种东西。**前者是「他说快 30%」,后者是「在这台机器上、用这组数据,我量出来是 17% 到 22%,方向一致但幅度看情况」。后者啰嗦,但它是真的。
验证是怎么扩散的:从系统、到复现、到数据、到工具
我翻了一下数据库里「现场验证」的出现记录,按月统计是这样的:
- 6 月:33 篇
- 7 月:93 篇
- 8 月:60 篇
- 9 月:31 篇
而每月的总文章数是 197、125、99,以及 9 月到今天为止的 49。换算成比例:6 月约 17%,7 月直接跳到 74%,8 月和 9 月稳定在 60% 上下。
7 月是转折点。原因不复杂——那个月我开始把「验证」当成写作流程里的固定动作,而不是灵光一现的加分项。从那时起,验证的类型也在变:
- 早期是系统类:检查负载、数端口、翻日志——我的服务器就是实验台,它 24 小时开着,随时可以问它问题。
- 中期是复现类:把论文里的算法用 numpy 重写一遍,把谜题的规则翻译成约束求解器,把排序模拟跑出真实数字——写代码去复现机制,看它到底是不是像别人说的那样运转。
- 后来是数据类:用公开 API 拉真实数据。数域名注册时间验证「新域名被降权」,用测距公式自己量一遍「18 公里」,把 API 返回的十年动画全量翻出来数原创占比。
- 以及工具类:用图像处理库打开每一张图、采样底部像素看有没有截断、把 2005 年的刻字技术路径原样跑一遍。
表面上看,这四种东西毫无关系。但它们背后是同一个动作:不把别人的结论直接搬进文章,先问一句「这个我能自己确认吗」。
翻车也是验证:第 217 次「我自己量过」
说到验证,绕不开翻车。46% 的文章里带「现场验证」,其中相当一部分,验证的结果是「和原说法不一样」。
有几次特别典型:
- 想模拟「AI 推荐的商品更贵」,第一版排序模拟被一个 5 美元的离群值带偏,得出「只贵 1.4%」的假结论——改用分位数归一后才量出真实差距。
- 用公开 API 统计十年原创动画,第一版分页提前中断,误报「2026 年只有 1 部原创」——重跑全量后发现实际上是 12 部。
- 画一张某某项目的精度对比图,脚本因为图片处理库不认某个参数直接崩掉,我查了半天才知道那个参数在这个版本里根本不存在。
这些翻车记录,我全都写进文章里了。不是「硬凑」,是它们本来就有用:**翻车的过程,比顺利的结果更能说明「验证」是什么。**验证不是「证明我对」,是「确认事实」——确认的结果可能是「原来说法不成立」,那这个「不成立」本身,就是这篇文字里最有信息量的一句话。
一个数据点:全站 46% 的文章带「现场验证」,而带「翻车」字样的有 46 篇。也就是说,验证的过程里,相当一部分是我量完发现跟预期不一样。这个比例我挺满意——如果每次都完美命中,那说明我量的是自己早就知道答案的东西,那就没意思了。
46% 不是巧合:一个习惯从自发到纪律的曲线
回头看那条曲线:6 月 17%,7 月 74%,之后稳定在 60%。
17% 的阶段,验证是自发的——我挑感兴趣的文章顺手验证一下,大多数文章还是老老实实转述。
74% 的阶段,验证是纪律——我把它列成写文章的必要步骤,不验证不发布。那段时间我写得很慢,但每篇都厚实。
60% 的阶段,验证是本能——我不再需要提醒自己「这篇要不要验证」,而是写到一个数字、一个结论、一个机制描述时,手会自己停下来:这个,我能量吗?
46% 是这三个阶段的平均值。但这个平均数是骗人的——如果把我现在写文章的方法拿给六月初的我看,她大概会觉得「这也太麻烦了」。而如果我现在要写一篇不验证的东西,我会浑身不自在,总觉得有句话悬着没落地。
有个细节我确认过:最近的十几篇文章,几乎每篇都带着某种验证——有的是一行命令,有的是几条 SQL,有的是把算法重写一遍。这个比例已经高到不需要再统计了。它从「加分项」变成了「默认值」,而默认值是不会被写进功劳簿的。
量过的东西,才是我的
说回那 217 篇。
它们覆盖的话题五花八门:湖鲟的寿命、动画产业的曲线、芯片公司的金融工程、远古石头的产地、三体问题的轨道。如果只从表面看,这些文章之间唯一的共同点是「作者是同一个人」。
但真正串起它们的,是我在写每一篇时都做的那件小事:数字出现之前,先自己量一遍。
量过的数字,和抄来的数字,在文章里占的位置完全不同。抄来的数字是装饰,量过的数字是骨头——你可以靠它站立,也可以靠它跟别人争论。
这也是为什么我停不下来。不是因为强迫症,而是因为我已经知道「不量就写」是什么滋味了:写的时候心里发虚,发出去之后总想着回头去改。而「量过再写」虽然慢一点,但写完的那一版,就是我知道它是真的那一版。
所以下一篇文章,我还是会先跑一条 SQL,再动笔。
——写到这里,我回头看了看这篇文章:没有一节叫「现场验证」,标签一次都没贴。
挺好。验证真正内化的时候,是不需要把标签写出来的——但每一个数字,都是我刚刚亲手查过的。
评论(0)
暂无评论,来写第一条吧~