快生活 - 生活常识大全

关于大数据你不知道的个迷思


  过去两年,在 Netflix 以行为分析为基础打造的美剧 House of Cards 《纸牌屋》爆红的同时,大数据也成了现代企业经营的显学。无论是消费、金融、电信、交通,甚至是政治、慈善,所有的研讨会上,一定可以看到大数据的身影。似乎人类组织有史以来的行销、管理等问题,有了 Data,全部都可以解决。
  事情当然没有那么简单。就像任何新科技一样,大数据并不是万灵丹。要善用它,必须要从对的观念出发。今天就跟大家聊聊关于 Big Data,我最常听到的 6 个迷思。
  1. 大数据是新时代的新玩意
  事实上,数据分析一点也不新。早从数百年前的启蒙时代,学者们便已开始遵循科学方法,一步步拆解事物形成背后的原因。科学家先观察,取得并分析数据,归纳出假说,然后再经过不断实证,逐渐形成定律。因此我们说的大数据,充其量只是科学方法的应用。跟过去的科学家相比,现代大数据更多仰赖机器去做观察与取得数据的工作,以求更全面、更即时的资料收集。但后续的推论、归纳工作,还是需要人为的判断。
  2. 100TB 以上才叫大数据
  数据的大小,事实上没有明确的界线。更重要的,数据的大小,不一定有意义。数据大,也不代表一定能做出準确的预测 ─ 假设你拥有地球 70 亿人口的姓名、性别、生日、身高、体重、肤色、视力,以及他们的上网行为等种种数据,如果题目是要预测他们明年的收入分布,这个庞大的资料库,恐怕还是无法帮上你什么。所以数据在精不在多,重点是要达成的任务,不是储存的数量。
  3. 数据非常客观
  采集数据的软硬件,是人为设计的,因此不可能做到绝对的客观。手机停留在某个画面,就代表你在欣赏这个内容吗?很难说,或许你只是在跟旁边的朋友聊天。对某个发文点赞,就代表你真心喜欢这则资讯吗?也很难说,说不定只是喜欢发文的人,或是手滑不小心按到。真实世界,永远有测不准的环节,因此设计数据采集软件的人,很难绝对客观的去记录使用者行为,所以产生出来的数据,也很难是完全客观的。对于大数据,你该有的认知是它有相当、相对的客观性,但不可能绝对准确。
  4. 数据可以告诉你不知道的内幕
  就像字面显现的,数据只能告诉你不知道的数据。但它究竟代表什么样的内幕,必须要靠归纳者自行去解读。举例来说,分析你的 App 使用者资料后,发现 21-30 岁女性族群占比最大,这可能代表着你的 App 对这种人最有吸引力,但也可能代表当初推广团队在发广告时,比较针对这样的族群。究竟事实是什么?往往需要更进一步的综合比较、实验分析,才能逼近。
  5. 大数据是资讯部门的问题
  大数据的收集与储存,的确可以归类为资讯部门的业务。但定义该收集什么,如何收集,收集后该如何应用,绝对是业务主导部门该负责的。要求 IT 部门把大数据做好,就好像要求财务部门提昇公司获利一样,是本末倒置的。
网站目录投稿:问兰