爱吧机器人网 » 技术 > 大数据 > 正文

《时代周刊》:用形象化的老办法对付大数据

《时代周刊》最新一期封面文章称,我们每天被数据海洋淹没,只有让冷冰冰的数据形象化,变成看得见摸得着的东西,我们才能从中挖掘出意义。

威廉-普莱费尔(William Playfair)生于1759年,在家里排行老四,父亲是上进的苏格兰大臣。他年纪轻轻便当上瓦特的个人助理,随后从事制图、会计、工程、经济、银匠、土地投机、记者等多种职业,取得大小不等的成功。最终他在贫困中去世。

不过在此过程中,他差不多是不声不响地一手创立了统计图表学,发明了柱状图、线形图和扇形图。1786年他出版《商业和政治地图集》,该书以一副英国历史进出口图开场,放在今天的话与本刊的排版看上去并不太脱节。用他自己的话说, 普莱费尔是将几何原理用于财政事务之第一人 。

他生不逢时。如果他活在当今时代,普莱费尔很可能身居硅谷一家受热捧创业公司的首席数据官高位。我们周围的世界发生着看不见但影响巨大的转变,即从信息稀缺到信息过剩的无声颠覆。人类进化首先面临的是食物短缺,如今我们却遭受着普遍肥胖之苦。

与之大同小异的是,过去我们获得信息很困难,现在到处都是海量的信息。谷歌前CEO斯密特曾经估计,人类每两天所创造的数据量就相当于有史以来到2003年的数据量总和。他说这话是在五年前。我们从认识上还未进化到这一步。

估计人类创造的总数据量是技术人员的一大爱好。确切数字虽然各不相同,但谁都承认大得惊人。只需想想你的智能手机就够了:没错,它是一个通讯设备,但它也是把你周围的世界转化为数据的工具。你看到某个东西,把它拍下来或者录下来,然后上传到云端,以字节的方式永远存在。每一天人们发布五亿条推文,在Instagram分享7000万张照片,在Facebook观看40亿条视频。每一分钟我们向YouTube上传300小时的新内容。

创造数据的不仅是人。还有被称为 物联网 的新现象。汽车、自动售货机、眼镜、计步器等装上传感器和传输器,与云端或彼此之间通讯。这些物体也像人类一样在数字世界留下痕迹。市场研究机构IDC在2014年的报告中估计,数字世界的规模将从2013年的10万亿吉字节增长到2020年的44万亿或44泽字节。

我们拥有丰富的数据,但从中获得的回报却迅速减少,因为拥有的数据越多,就越难从中挖掘出意义。颇具讽刺意味的是,信息过多差不多也像信息不足一样难以分析和理解。于是,新技术让我们的世界充斥着越来越多的复杂信息,我们最终就越需要有着悠久历史的人类努力,即始终致力于使复杂的东西可以理解、从混乱中求得意义的艺术,尤其是视觉艺术。

正如普莱费尔所发现的那样,超过某一界限挖掘数据意义的最佳办法就是使数据形象化。试想Instagram的海量照片。去年纽约市立大学教授曼努维奇(Lev Manovich)对来自纽约、圣保罗、柏林、曼谷、莫斯科5座城市的12万张照片进行了视觉分析。他和他的研究团队从中选取自拍照片,估计照片上的人的年龄和性别。然后他们对照片运用面部分析 算法 ,对所有数据进行统计分析,最后放到selfiecity.net制成互动图表。

结果这些毫无意义的原始数据现在具有了意义。你可以按照城市、性别、心情、是否歪脑袋、是否戴眼镜、睁开还是闭上眼睛浏览照片。你可以提出问题并得到答案:谁自拍用的多,男人还是女人?(答案是女人)。哪里的人笑得最多?(曼谷)哪里的老年人爱自拍?(纽约)

如果你把数据形象化看作我们抵抗信息海洋的防洪堤,那么随着数据日益增多,防洪堤的压力总是不断上升,而压力上升又改变了数据形象化的方式和作用,这一点甚至普莱费尔也不曾料到。

形象化从对统计数据集的分析呈现发展为实时数据的不断变化图景。在Bostonography你可以像上帝一样鸟瞰波士顿所有按照当前时速进行颜色编码的公交车位置。Crimemapping.com实时显示按照报案地点分类的案发地情况,用不同表情符号代表不同性质的案件。fbomb.co网站提供上推特的人何时何地如何说国骂的全球实时图景。

从 纽约出租:生命中的一天 (NYC Taxis: A Day in the Life)可以得见美观、免费的数据丰富性。一位名叫Chris Whong的黑客根据《信息自由法》从出租车与电召车委员会(TLC)下载50G纽约市出租车数据,利用这些数据制作了2013年某一天任意出租车的路线和收入图。你可以选择一辆车快进(或以正常速度 如果你有时间)观看它在曼哈顿大街上行驶,像勤劳的小精灵吃豆子那样在身后留下一条蓝线。

数据形象化并非总是为了闹着玩。今年4月30日在Kickstarter发布的一个众筹项目将从OpenSecrets.org抓去竞选资金数据并以多种方式自动图像化,清楚、简洁地显示政治家获得的资金数量和来源。这是超越透明性的下一个必要步骤:不仅公布信息,而且要公布该信息的意义。今年数据图像化最引人注目、最具革命性的实验之一是纪录片制作人、数据专家霍洛兰(Neil)的 二战死难者 (The Fallen of World War II)互动视频。该实验利用图表图像讲述历史:表示成千上万死难者的几乎独家的抽象数据形象化地带领我们回顾二战和 大屠杀 。

视频六分钟左右镜头急剧仰拍现出摩天大楼似的柱状图,表示前苏联军队870万人的伤亡。初一看似乎极不可能,但随着镜头回摇,在二战的巨大灾难中又合情合理。在这种不动声色的叙述中,人类的死亡更显触目惊心。

之后的视频同样摄影手法反复出现:冷冰冰的抽象数据变为视觉艺术,让我们感同身受,增加知识。现阶段人类遭遇普莱费尔也发现无法理解的海量数据。我们也觉得数据多得无法理解,而这些数据又可能使得我们的世界不可理解。不过我们并非毫无办法。信息不仅需要自由,它还需要看得见摸得着。


上一篇:大数据笼罩下的隐私危机:我们是新时代楚门
下一篇:科学家利用大数据VR应用浏览基因组
精选推荐
瑞士研发出微型机器人集群 可像蚂蚁一样互相交流并协同工作
瑞士研发出微型机器人集群 可像蚂蚁一样互相交流并协同工作

[2019-07-12]  EPFL(瑞士联邦理工学院)的研究人员受到了蚂蚁的启发,开发了一款仅有10克重的小型机器人:他们可以相互交流,分配角色并完成复杂的任务。 ...

CES 2018:英特尔推出49量子位芯片争夺量子霸权
CES 2018:英特尔推出49量子位芯片争夺量子霸权

[2018-01-10]  在与Google、IBM的一场关于建立量子计算系统的马拉松比赛中,英特尔通过了一个关键的里程碑。近日,这个科技巨头已经推出了一个49个量子位 ...

什么是机器人学?机器人学简介
什么是机器人学?机器人学简介

[2017-12-14]  机器人学是工程学与科学的交叉学科,包括机械工程,电气工程,计算机科学等。机器人技术涉及机器人的设计、制造、操作和应用,以及用于控制、感官反馈和信息处理的计算机系统。...

谷歌在中国成立一个新的人工智能(AI)研究中心
谷歌在中国成立一个新的人工智能(AI)研究中心

[2017-12-13]  谷歌正在中国建立一个新的人工智能(AI)研究中心,希望进一步扩展到中国,以充分利用中国高度重视的人工智能技术。人工智能是目前地球上最具竞争力的领域之一,亚马逊,微软......

九台“猎豹”机器人组队踢球,麻省理工高材生们的高级趣味
九台“猎豹”机器人组队踢球,麻省理工高材生们的高级趣味

[2019-11-09]  本周,在麻省理工学院10号楼外草坪上展开了一场别开生面的足球比赛。在绿草如茵的基利安球场上,一群由人工智能驱动的机器人就是这场比赛的 ...

受大脑控制的机器人
受大脑控制的机器人

[2017-03-21]   想让机器人做我们想做的,首先,他得全面地了解我们。通常,这就意味着人类需要要付出更多。比如,教机器人复杂的人类语言或者把一项任务 ...

一个让深度学习惨败的通用人工智能领域——语境处理
一个让深度学习惨败的通用人工智能领域——语境处理

[2019-11-04]  Context是指用来解释一段给定文本或语句的来源框架,我们可以翻译为上下文或语境。维基百科将context定义为:*在符号学、语言学、社会学和 ...

这些人型机器人是如此真实,你的肉眼几乎无法区分
这些人型机器人是如此真实,你的肉眼几乎无法区分

[2017-09-03]   我们生活在一个区分现实与幻想变得越来越困难的世界。由于机器人技术的进步,创造人工的人类正在逐渐接近完美的最终目标。我们现在看到的机器人不再只是一块发光二极管,......

本周栏目热点

做为一名大数据新手 应该通过这篇文章了解大数据

[2018-07-23]  一、大数据是什么?大数据,big data,《大数据》一书对大数据这么定义,大数据是指不能用随机分析法(抽样调查)这样捷径,而采用所有数据进 ...

BAT大数据野心:数据生产全链条浮现

[2016-07-12]   本报记者 周慧 北京报道导读以BAT为代表的中国 互联网 企业,在数据领域各有千秋,百度的搜索数据、阿里的电商数据、腾讯的社交数 ...

为什么说发展大数据是有道理的

[1970-01-01]   近日,习主席考察贵州时提到:贵州发展大数据确实有道理。那么为什么说发展大数据是有道理的?从历史的 ...

《时代周刊》:用形象化的老办法对付大数据

[1970-01-01]   《时代周刊》最新一期封面文章称,我们每天被数据海洋淹没,只有让冷冰冰的数据形象化,变成看得见摸得 ...

从Facebook社交媒体情绪实验看大数据道德困境

[1970-01-01]   今年曝光的Facebook私自进行社交媒体用户情绪实验的新闻引起了不小的争议,这把很多数据实验卷入到社会 ...