认清大数据四大误区:大数据终将消除经济自由是最大谬误

误区四:把“大数据”当作“小数据”用,分析采用部分局部数据。

经济社会中,如果取得的数据样本有限,就需要确立有效的分析框架,建立模型,确立函数关系,做回归分析。然而,如果样本不仅是充分的,而且是完整的,是全量的,那么数据分析就要摆脱既有的旧模式了。从全样本的大数据中,收窄样本数量,只选取部分样本用来分析,是一种缩量的方法,缩量样本分析后的结论又要适用于总量,这就是对大数据的“小用”。

举例来说,如果能够获得一个城镇全部机动车以及全部外埠入城车辆的运行状况,我们就可依所设议题来直接抓取数据,获得结论。抽样建模分析及其回归分析,就不仅累赘,而且极有可能铸成大错。简单来说,大数据,就是扳手指头数不过来的状况,交给机器与程序去“扳”,不仅数得过来,而且数出来了。大数据往往更多地可以直接抓取并使用,而非在数理化、模型化、函数化等“加工”后再使用。

大数据具有完整性和全局性的特质,如果采用部分局部数据,然后试图得出超出部分局部数据范围的结论,这种既有的思维惯性,并不适用于大数据的逻辑和现实。大数据不能当作小数据用,小数据终归拼不出完整的大数据。