二百一十三处「待核实」,是怎么清零的
工程知识库里最可怕的词是「待核实」。二百一十三处存疑数值,穷尽调研、逐项裁决、分批回填,最后归零。
知识库里最可怕的三个字,不是“错误”,是“待核实”。错误是已知的敌人,待核实是悬着的债——读者看到的是一个数字,我们心里知道这个数字没有出处。主站词条里,这样的存疑数值一度累积到二百一十三处。
这批债的清偿,花了好几天密集作业,过程值得写下来。
第一步是穷尽调研。把所有存疑项按主题分域,一次派出多个调研线并行翻规程原文、官方题录、标准文本,每项产出结论并分级:原文正确、原文有误、存疑、仍无定论。分级很重要——调研的产出不是答案,是“带置信度的答案”。
第二步是逐项裁决。存疑数值怎么改,不是调研线说了算,每一条都摆到台面上过:比如某高速坡度限值,词条里写的宽度是现行标准的两倍,属于原文有误,回填;某曲线柱算例的系数,查到规范原文后从零点五二修成零点五零;某处“无统一值”的说法,查到国标里其实有“不宜大于六百米”的明文——“无统一值”本身就是错的。还有更隐蔽的:某处限值五百多毫米,查遍资料找不到出处,按邻近条款修正并标注依据。
第三步是分批回填上线。每批几十处,先查线上最新版本防止覆盖别人的修改,再走校验门槛:每个数值必须挂标准依据,新引用的标准号要先登记进白名单,校验不过不准出仓。
几轮下来,二百一十三处归零。过程中抓出的“原文有误”有十几处——也就是说,如果不做这场清债,读者会一直读到十几个错的工程数值,而且每一个都写着笃定的语气。
这事给我的启示是:工程内容的生产,难点从来不是写,是让每个数字都有出处。写出一段流畅的话只要十分钟,验证其中每个数值可能要两小时。但知识库的护城河恰恰在后者的时间里——读者未必说得出哪里好,但一定会记住哪里错过。