当前位置:经济频道首页 > 产经 > 正文

认清大数据四大误区:大数据终将消除经济自由是最大谬误(2)

2017-08-17 13:38:21    中国新闻网  参与评论()人

误区二:大数据是全量数据,能够预知未来。

“大数据”并不能“全能性”地预设未来,但是能否“先知”般地预知未来?同样,做不到。因为,大数据在时间上是有约束条件的。依凭历史数据,能够预知未来吗?

大数据是全量数据,源于事实,也是事实,它并非既有经济理论变量性的函数分析,并不能在时间轴上理所应当地延展开去。在时间轴上,大数据终归是局部的,远非全量,它是实然的,是已发生的,即其性质上仍然是历史数据而已。

大数据本身不是先知,也没有谁能通过大数据成为先知。基于大数据并不能建构所谓的“历史规律”,更谈不上把同大数据有所谓“关系”的某人或某类人嵌入到这一所谓的历史规律中去,进而使其发挥主观能动性,担纲某种角色。历史数据对于未来有一定的作用,但是根本上讲,历史数据并不能决定未来。没人能够凭依大数据而可预知未来,成为先知。

误区三:大数据包揽一切信息。

数据的标准化与格式化,决定了大数据不是“全息”的。

全知是指在一定标准或口径下的全量数据,但并不意味着包揽所有信息。信息的完整性是一个抽象而复杂的问题。数据信息往往是静态的,是在一定时间点下的结论,其被有效地获取甚或表达出来,就意味着一部分信息是确定的、静态的,而另一部分则是不确定、动态的。这就好像猫的眼睛一样,当你用相机去拍摄它时,它便发生变化,也就是必然丢失掉或隐去一部分信息。所以,全知是就对象自身而言的,并非是与对象有关的全部信息而言的。

现实中,人们对于大数据的感受确是非常丰满有力、醒目而刺激的,这种情况一时间使人们感性上误以为这就是全息的。事实上,这种情形以往也反复出现过,有如第一次听到电话听筒里传来另一端亲友的话语,便以为那是真声音。

误区四:把“大数据”当作“小数据”用,分析采用部分局部数据。

经济社会中,如果取得的数据样本有限,就需要确立有效的分析框架,建立模型,确立函数关系,做回归分析。然而,如果样本不仅是充分的,而且是完整的,是全量的,那么数据分析就要摆脱既有的旧模式了。从全样本的大数据中,收窄样本数量,只选取部分样本用来分析,是一种缩量的方法,缩量样本分析后的结论又要适用于总量,这就是对大数据的“小用”。