内容摘要:与传统数据相比,大数据的资源性特征尤为突出,成为各国重视开发大数据的依据。
关键词:大数据时代;数据革命;社科研究
作者简介:
【核心提示】与传统数据相比,大数据的资源性特征尤为突出,成为各国重视开发大数据的依据。在知识的演化过程中,数据既是产生信息、知识、智慧的基础,又同时贯穿于其中。进入信息化时代,遇到的最大难题不是信息不足,而是信息孤岛的问题,只有实现大数据的共享和规范管理,才能破解这一难题。
曾几何时,数据是人类用于识别环境的计数工具,对其精确性的关注似乎仅限于科学研究领域。进入信息化时代,我们每一个人都明显感受到与信息相关的数据无处不在。可以说,我们自身在不断产生各种数据的同时,数据也在极大地影响我们。
两次数据革命融合数据与科学研究
在数据的发展历程中有过两次革命。第一次数据革命是近代科学诞生之时,实现了数据与科学研究的融合,数据在科学研究中的基础地位得到确立。对研究过程和结果赋予精确化的诉求,是近代科学的基本特征之一。在以数据为依据的研究范式中,数据的可靠性和准确性代表了研究的精确性,人们甚至将以数据为依据的实证研究作为判断“科学”与“伪科学”的标准。
随着科学和技术的发展,数据的形式和内涵也在不断变化和发展。除观测数据、实验数据、理论数据、统计数据、模拟数据等外,图、表、文字均被纳入数据行列,形成了结构化数据和非结构化数据的多元化数据形式;信息技术的发展导致从数据匮乏向“数据丰富,理论匮乏”方向转变,数据产生的速度和规模急剧发展;数据所蕴含的信息远远超出其工具性和依据性特征,形成可以从中挖掘出新知识的大数据。与统计数据相比,大数据强调的是全部样本;与科学数据的精确性相比,大数据允许存在一定范围的不准确性;与科学范式的因果关系相比,大数据通过关联性寻求自然和社会的变化规律。因此,大数据引发了第二次数据革命,它不仅改变着科学研究范式,实现社会科学研究的定量化,也将促使经济、社会、军事等所有社会领域产生巨大的变革。







