大数据不是万灵药

来源: 人民日报
2014/4/30 13:57:12
大数据时代已经来临,但它并非无所不能。一方面,我们在不能矮化大数据为“旧瓶装新酒”的同时,更不能迷信大数据为万灵药。

分享到: 新浪微博 腾讯微博
本文关键字: 大数据
毋庸置疑,规模更大、更新更快的大数据拥有深刻的洞察力,也终将带来价值。有些鼓吹者认为,随着数据采集和分析工具进一步完善,数据就能大到可以自己得出结论。甚至谁掌握了大数据,谁就能够预知未来。
这种把大数据当万灵药的观点是危险的。首先,在低价值密度的大数据中,数据往往是混杂的,找到“货真价实”的信息已属不易,而“知其然,不求知其所以然”,只考虑纯粹相关性,而不注重数据与结论之间的因果关系的分析方法,在现实中往往经不起推敲。
此外,由于存在样本误差和偏差等种种“陷阱”,通过统计数据来认知现实世界从来都不能尽善尽美,而这些不是简单的依靠扩大样本规模就可以避免。比如,理论上可以通过分析微博上的每一次发言,推断出某一事件引发的公共情绪,但不可忽视的是,微博活跃用户并不代表更大外延的所有人。
大数据时代已经来临,但它并非无所不能。一方面,我们在不能矮化大数据为“旧瓶装新酒”的同时,更不能迷信大数据为万灵药。否则,带着“数据自己可以说出结论”的傲慢,不小心就可能掉进了数据的“陷阱”,从而使大数据成为“大错误”。我们的切实态度或许是,在尊重传统的统计经验基础上,借助更大规模的数据,解决新问题,才能期望获得真正的大价值。
责编:李玉琴
vsharing 微信扫一扫实时了解行业动态
portalart 微信扫一扫分享本文给好友
著作权声明:kaiyun体育官方人口 文章著作权分属kaiyun体育官方人口 、网友和合作伙伴,部分非原创文章作者信息可能有所缺失,如需补充或修改请与我们联系,工作人员会在1个工作日内配合处理。
最新专题
流动存储 为大数据而生

伴随信息技术的突飞猛进,更大量级的非结构化数据与结构化数据构成的大数据成为企业级存储所面临的最大挑战:一方..

磁盘阵列及虚拟化存储

利用数组方式来作磁盘组,配合数据分散排列的设计,提升数据的安全性。虚拟化存储,对存储硬件资源进行抽象化表现。

    畅享
    首页
    返回
    顶部
    ×
    畅享IT
      信息化规划
      IT总包
      供应商选型
      IT监理
      开发维护外包
      评估维权
    客服电话
    400-698-9918
    Baidu
    map