大部分企业『大数据』并没有卵用 近90%都是垃圾数据

2015年07月06日 44563次浏览


PayPal 联合创始人兼风险投资人彼得·蒂尔(Peter Thiel)经常抱怨科技圈一直在过度使用像“云端”和“大数据”这样的流行词。虽然他 不是唯一一个长期表达这种观点的人 ,但是大部分企业似乎仍然没有充分理解这条信息。

 

很多企业经常会吹嘘自己拥有多少 TB,甚至是 PB 的数据量,还有它们的大型数据科学家团队正在使用 Apache Kafka 流运行海量的 Hadoop 集群,这些企业认为这些都是它们的竞争优势所在。

 

然而,事实上它们当中的大多数都遇到了计算机领域的一个老生常谈的问题:无用输入,无用输出(garbage in, garbage out)。它们不仅没有符合大数据定义的数据复杂度或数据量,而且它们拥有的实际上是劣质数据,它们的业务甚至有可能会因此蒙受损失。根据 Experian Data Quality 的数据,

尊敬的用户:
当前内容已经归档,暂时无法访问!