一句话定义
关于你所处环境的完备材料,不存在一份现成的、别人已经备好的版本。尤其是那些正在变化的情况,任何外部机构都不可能替你持续更新。
机制 / 原理
文本给出的理由分两层。一般地说,当时的中国没有哪个机构在系统地准备社会情况材料,所以非自己动手搜集不可;特殊地说,实际工作者需要随时了解变化着的情况,这一层是任何人都不能依靠别人预备的。第二层才是这条方法真正持久的部分:即使今天存在大量现成数据,它们描述的也是被定义过、被采集过、且已经发生过的部分;正在变化而尚未形成指标的东西,永远只能靠自己去看。文本还特意点出一类人最需要做调查——只懂得理论不懂得实际情况的人,否则他们无法把理论和实际联系起来。
经典实验 / 例子
序言里讲了一件很实在的事:作者早年用开调查会的方法得来的材料,湖南的几个、井冈山的几个,都失掉了;所以后来印出来的主要是《兴国调查》《长冈乡调查》和《才溪乡调查》。他把开调查会称作「比较什么大学还要高明的学校」,并说明为什么必须自己搜集——一般情况下没有人替你准备好这些材料,而实际工作者要随时了解正在变化的情况,这件事任何人也不能依靠别人代劳。序言最后特意声明:出版这份材料的目的是指出一个了解下层情况的方法,而不是要人们去记那些具体材料和结论。
书中案例出处
「非做搜集材料的工作不可」
区分一般情况与特殊情况两层理由,后者指向随时变化的情况无人可代劳。
指出现成材料的边界在于「已被定义并采集」,这一边界至今成立。
生活中的例子
一家餐饮品牌的选址团队一直依赖第三方购买的商圈人流数据开新店,连开三家都低于预期。新任负责人要求团队在候选点位自己蹲三个工作日,分时段人工记录:进出人群的年龄结构、手上提的是什么、往哪个方向走。数据买来的人流量确实没错,但自己数出来的结果显示其中七成是穿行而非停留,且午市时段以送餐骑手为主。这条信息不在任何一份采购数据里,因为没有人把它定义成指标。
常见误区
误区:认为现在数据这么发达,行业报告、平台后台、第三方数据源已经足够,自己跑一线是低效的重复劳动。这个判断有相当的合理性——凡是已经被定义为指标并被持续采集的东西,自己去数确实是浪费。问题在于现成数据的边界:它只能覆盖有人愿意采集、且已经想清楚该怎么定义的部分。正在出现但还没被定义的变化,恰恰是判断最需要的信息,也恰恰是所有现成数据源共同的盲区。分工应当是:能买到的不自己数,买不到的必须自己去看。