慧数汽车大数据首页>公司动态

大数据中科点击

中科点击:大数据“热”潮中的应用“冷思”考

2016-10-13 16:16


摘要

大数据概念的形成和发酵,在当今社会引发了人们无限的遐想和期待,也如一股热潮,不断汹涌,受到普遍的欢迎和推崇。

大数据概念的形成和发酵,在当今社会引发了人们无限的遐想和期待,也如一股热潮,不断汹涌,受到普遍的欢迎和推崇。一时间,甚至感觉大数据无所不能,真如神一般地存在。但是,我要说的是大数据并不是神话,也不是高高在上的神,大数据的法力究竟有多大,究竟能够产生多大的威力,我们到现在来说也不得而知。这种令不少人癫狂、着迷的东西是否真的“法力无边”,我们不妨试发三问。
既然说大数据的特点在“大”,那么是否越大越好?
数据的大小是相对而言的,数据越大并不是价值越大。我们可别忘了大数据另一个特点是价值密度低,所以说,很多数据是无效数据,需要经过数据清洗才能为我们所用,产生很大的价值。

人类对世界的认识,首先是感知信息,但是信息不等于数据。比如说,你发了条短信给对方,对方收到的是你发的信息,但是在电信的线路中就会沉淀信息传输的相关数据。但问题在于,人类许多方面的感知能力却不如普通动物,比如人的嗅觉不如狗,听觉不如猫,视觉不如鹰等等。

难道高级动物竟然比不上低等动物?显然不是。奥秘在于人类相对普通动物而言,长处在思维。思维之花乃是生物进化的杰作,人类凭借思维之利器,便可以通过科学技术手段,根据需要延长自身的器官,最后实现各方面能力都远在一般动物之上。在此过程中,关键是计算机技术的发展,得以替代人的部分逻辑思维,能够进行大规模数据的快速处理,从而使得我们在面对大数据时,不至于心怀畏惧。

大数据的价值不在于数据本身,而在于数据之间关联分析产生的价值。20世纪以来科技领域看起来硕果累累,但真正具有颠覆性意义的发现却如凤毛麟角,甚至不及19世纪。问题何在?数字化的数据固然有利于从中发现规律,但这类数据在整个大数据库中所占份额极小,何况还有一个鱼龙混杂问题。至于那些尚未数字化的数据,尤其是那些似是而非、众说纷纭的数据,显然并非越多越好。

事实上,就人类认识而言,也有减材加工与增材加工两种方式。做大数据也需要去伪存真,去粗取精,由此及彼,由表及里的认识过程。其实就是讲的真理性认识有增有减的过程。当年第谷观察天象,所做工作就是增加数据;而开普勒总结天体运行规律,所做工作则属删繁就简。如果说数据的增加意味着真理性认识的增加,那么数据的减少则意味着真理性认识的深化和升华,何尝不值得我们同样为之喝彩?
大数据 的亮点在“数”,是否万物皆数?
我们总人认为,大数据时代来临了,就像互联网时代来临一样,所有的行业都要披上互联网的外衣,或者互联网化。但是大数据会不不会将所有的行业都大数据化,答案是显而易见的,这几乎是不可能的。

数字的发明,是人类抽象思维能力发展的产物,但是数据不等于数字或者数值。而发现数字之间的某些关联,曾经更使人类欣喜若狂,毕达哥拉斯甚至据此作出了“万物皆数”的断言。大数据之所以吸引人们眼球,噱头就在“数”上,似乎一切化归于数,就可万事大吉,适合数字化生存的时代要求了。

    应该看到,世界在演化的进程中,特别是生命体和人类社会诞生后,正负二分的表征法就变得越来越不适用了,无论是模拟仿真技术的兴起,还是复杂化方法的运用,都说明这种建立在非此即彼的认识论基础上的进位法,其实是形而上学思维方式在信息时代的反映。

由此可见,所谓的数据其实有两类,一