爱吧机器人网 » 技术 > 大数据 > 正文

大数据的未来之路

到了2020年,人类一年所产生的数据将是1000个谷歌或10000个百度,在数据化生存时代,企业要做哪些准备?

大数据 启蒙阶段,《 大数据 时代》作者、牛津大学教授维克托·迈尔·舍恩伯格曾应邀去多家中国著名企业宣讲过 大数据 带来的变革;最近一年,各类 大数据 方案企业也开始越来越多地谈论 大数据 技术的实现。

今年夏季,在腾讯举办的 大数据 论坛上,腾讯高管与来自全球最顶尖的学者热烈地讨论着 大数据 的各种迷思——隐私、互联互通和数据交易。在最近一个 大数据 的活动中, 大数据 开源技术Hadoop之父Doug Cutting以及 大数据 链条上掌握着命脉的“原油型”公司——英特尔和Cloudera的牛人们再次聚首。

数据化生存

IT行业的“指数效应”威力惊人,比如,IT的基石芯片行业有个摩尔定律,每18个月芯片上集成的晶体管数会翻番,由此会带来一系列指数式连锁反应——CPU的性能翻番,芯片的成本折半,功耗也会折半。这也就是大家为什么看到电子产品快速降价的根本原因。

市场调研公司IDC认为, 大数据 行业也有“摩尔定律”。英特尔中国研究院院长吴甘沙非常认同这个说法,他曾是英特尔中国研究院首位“首席工程师”,主持 大数据 研究。“如果说摩尔定律是我们所在的指数社会的基因,那么 大数据 就是指数社会的蛋白质。”吴甘沙说。

有人说 大数据 是新的原材料、新的原油、新的资产,甚至是新的货币,而吴甘沙认为,人类现在的生存就是一场数据化生存。人类社会的各类设备在不停地感知、传输、存储数据。今天,人们认为谷歌可能是最大的数据拥有者之一,但按照指数增长规律,到2020年,一年所产生的数据将是1000个今天的谷歌或10000个百度。

“我们看到数据和计算能力在过去15年间一直呈现指数级增长,这种增长给我们带来了根本性变化——不能再看单独的数据,而是把全部数据放在一起来考虑,来描绘出对人、企业或是业务的高清晰图像。” 大数据 之父Doug Cutting说,“这件事是一个革命性、阶段性的变化。”Doug Cutting是开源技术世界中一个很具影响力的人物,他打造了目前在 云计算 和 大数据 领域里如日中天的开源技术Hadoop。他是Apache 基金会主席,也是 大数据 平台企业Cloudera的首席技术官。

大量、快速增长的数据需要实时储存、整合和分析,过去的IT架构已经无法应付,这就促成了一种名为Hadoop开源新架构的诞生,这是个可以无限扩容的分布式计算结构。

在这个无限扩容开放式架构的发展大势下,IT业界才倡导了“软件定义基础设施”的趋势,把计算、存储和网络做成开放式的标准模块,降低设施的门槛;在基础设施之上,推动开放、可信数据处理平台Hadoop;在此之上,推动整个生态圈的创新,实现各类分析应用,把高级分析功能平民化,使得它能迈入主流市场,实现规模经济。

数据咖啡馆

腾讯高级副总裁汤道生曾请教欧洲信息哲学创始人、牛津大学教授Luciano Floridi一个困扰腾讯 大数据 应用的问题——数据如何互联互通,这对于发挥数据的价值至关重要。

现在,数据已成为各个组织的商业资产,数据交换成为一个挑战。Luciano以人类早先对石油资源的应对方式进行类比:挪威当年建立了复杂的综合体系去处理自然资源,从而让整个人群受益。现在,政府和手握数据的企业也有责任去摸索一个综合体系,把数据的价值扩大到广泛的人群。

在英特尔,吴甘沙他们也正在开展“数据 安全 流通以及定价”这样的研究。英特尔有一个研究平台,叫做“数据咖啡馆”,意思是希望这个平台能像咖啡馆那样起到“汇聚”作用,汇聚不同领域、不同企业的数据,一起来产生新的价值。这里面需要大量的核心技术,例如,顶层的多方 安全 计算、数据审计及定价等。

英特尔与美国癌症研究机构开展合作。癌症是一个典型的长尾病症。过去50年来,癌症的治愈率仅仅提升了约8%,这是因为研究机构拥有的基因组样本太少了。如果通过“数据咖啡馆”把基因组样本聚合起来,就能期待癌症技术获得突破。而聚合就需要数据交易。

在某种程度上,目前的数据是论斤按两来交易的,因为数据的价格很难衡量与预测。“在这样一种数据不易定价的情况下,我们的理念是先用起来,在使用过程中去发现它的价值。”吴甘沙说。

在英特尔宏大的愿景中,希望在2020年之前,一天之内能完成三件事:对病人进行全基因组测序,锁定癌症的相关基因,形成个性化的用药以及修复方案。现在癌症很难治愈的原因是新药更新速度赶不上癌细胞的变化速度,有了 大数据 技术,癌症治愈率将指日可待。

数据交易只是英特尔在 大数据 研究上的重要方向之一。英特尔的其他重要研究领域还涵盖两个重要领域:数据与机器的关系——什么样的可扩展架构能更好地存储和处理数据;人和数据之间的关系——什么样的分析工具能增强人的分析能力。

以往,在英特尔,1~3年的事由产品部门来做,3~5年的由英特尔研究院来做,5~8年的与大学合作研究。但在这样一个不可预测的时代下,英特尔把对“ 大数据 ”的研发周期进一步缩短,与大学合作研究的技术也希望尽快推向市场,像Spark、集成了 数据分析 及交换的Datahub,内存数据库H-Store、可视化、深度学习(Deep learning)等。

大数据 之星

今年3月,英特尔以7.4亿美元收购了Cloudera18%的股份,成为Cloudera的战略投资者。一家IT巨头的高管评论说:“英特尔占领了 大数据 领域的制高点。”

Cloudera是一家在 大数据 领域起着关键作用的创新企业。它由来自Facebook、谷歌、雅虎和甲骨文的高管和工程师在2008年创建,其商业模式类似Linux领域的开源软件企业红帽公司(Red Hat)。

上一页12下一页

上一篇:互联网征信:如何处理数据问题是关键
下一篇:移动应用决策平台App Annie获D轮融资5500万美元
精选推荐
麻省理工又秀神技:推出如魔法般跳跃的方块机器人集群
麻省理工又秀神技:推出如魔法般跳跃的方块机器人集群

[2019-10-31]  几天前,小编向大家介绍过麻省理工(MIT)研发的一种自组装机器人集群(点此阅览),它们可以用统一标准的小单元自动组装出各种大型结构。 ...

谷歌宣布搜索算法重大升级,用BERT模型理解用户搜索意图
谷歌宣布搜索算法重大升级,用BERT模型理解用户搜索意图

[2019-10-26]  谷歌刚刚宣布,其搜索引擎的核心算法正在进行一项重大升级,这项升级可能会改变10%的搜索结果排序。此项升级应用了自然语言处理技术(BERT ...

2023年服务机器人市场将超过250亿美元
2023年服务机器人市场将超过250亿美元

[2017-09-04]  全球服务机器人市场预计到2023年将达到250亿美元, 并在预测期内登记15% 的复合年增长率。短期中期回收期和投资回报率高 (ROI), 以及在教育和研究、临场感、防御、救援和安......

谷歌大脑发布ROBEL基准 鼓励用低成本机器人训练AI系统
谷歌大脑发布ROBEL基准 鼓励用低成本机器人训练AI系统

[2019-10-11]  训练AI系统的机器人D& 39;Claw和D& 39;Kitty用于控制机器人的人工智能系统,测量其性能所使用的基准通常仅限于为工业环境设计的昂贵硬件, ...

美国喷气推进实验室的AI驱动无人机挑战人类飞行员
美国喷气推进实验室的AI驱动无人机挑战人类飞行员

[2017-12-08]  随着无人机及其组件越来越小,效率越来越高,功能越来越强大,我们已经看到越来越多的研究开始让无人机自主飞行在半结构化的环境中,而不依赖于外部定位。 宾夕法尼亚大学在......

人工神经网络技术解码人类行为和想象时的大脑活动信号
人工神经网络技术解码人类行为和想象时的大脑活动信号

[2017-08-23]  为搜索引擎过滤信息,棋盘游戏对弈,识别图像 人工智能在某些任务中远远超过了人类智能。来自弗莱堡由神经科学家私人讲师Tonio Ball博士领导的几个杰出的BrainLinks-Bra......

CES 2018:英特尔推出49量子位芯片争夺量子霸权
CES 2018:英特尔推出49量子位芯片争夺量子霸权

[2018-01-10]  在与Google、IBM的一场关于建立量子计算系统的马拉松比赛中,英特尔通过了一个关键的里程碑。近日,这个科技巨头已经推出了一个49个量子位 ...

MIT研制出可以像植物一样生长的机器人
MIT研制出可以像植物一样生长的机器人

[2019-11-09]  麻省理工学院开发了一种新型机器人,这种机器人可以本质上自我延伸,其生长方式与植物幼苗向上生长的方式惊人相似。值得注意的是,研究人员 ...

本周栏目热点

做为一名大数据新手 应该通过这篇文章了解大数据

[2018-07-23]  一、大数据是什么?大数据,big data,《大数据》一书对大数据这么定义,大数据是指不能用随机分析法(抽样调查)这样捷径,而采用所有数据进 ...

BAT大数据野心:数据生产全链条浮现

[2016-07-12]   本报记者 周慧 北京报道导读以BAT为代表的中国 互联网 企业,在数据领域各有千秋,百度的搜索数据、阿里的电商数据、腾讯的社交数 ...

为什么说发展大数据是有道理的

[1970-01-01]   近日,习主席考察贵州时提到:贵州发展大数据确实有道理。那么为什么说发展大数据是有道理的?从历史的 ...

《时代周刊》:用形象化的老办法对付大数据

[1970-01-01]   《时代周刊》最新一期封面文章称,我们每天被数据海洋淹没,只有让冷冰冰的数据形象化,变成看得见摸得 ...

从Facebook社交媒体情绪实验看大数据道德困境

[1970-01-01]   今年曝光的Facebook私自进行社交媒体用户情绪实验的新闻引起了不小的争议,这把很多数据实验卷入到社会 ...