爱吧机器人网 » 技术 > 机器学习 > 正文

Graphcore 研发出AI芯片让机器学习提速百倍

作为英国最热门的创业公司之一,Graphcore专注于加速复杂机器学习模型的训练以及推断过程。他们正在开发人工智能芯片,以降低企业数据中心和云端使用AI应用程序的成本,并将性能提高达到目前最快的系统的100倍。

\
 
该公司计划在2018年初将其第一代AI芯片交付给第一家客户。但是,由于许多互联网服务都是在云端进行处理,因此仍要一段时间才能在智能手机等设备上安装芯片。
 
包括Facebook和Google在内的许多互联网公司都在努力使自己的视频广告与人们观看的内容更有相关性。他们的算法无法捕捉到每个视频上每一帧的图片,以帮助它更有效地锁定人们关注点。这将是一个非常复杂的过程,涉及大规模地实时计算大量数据。
 
这只是人工智能众多突破中的一个例子。为了让视频广告更有效地锁定用户,我们需要更强大的芯片来处理每天上传的所有视觉信息。Graphcore正在开发顶尖的处理器,为下一代AI软件提供支持,以更好地了解用户,并在YouTube等大视频平台上为广告定位软件提供支持
 
智能处理单元
 
Graphcore  开发了一种专用于机器智能工作负载的新处理器,并将其命名为智能处理单元(IPU)。它已被调整为能够高效地处理机器智能工作负载所需的大型复杂高维模型。该系统具有超过14,000个独立的处理器线程,并强调并行,低精度点计算,并提供比其他解决方案更高的计算密度。

\
 
智能计算如何工作 
 
1.     学习 - 将数据放入高维知识模型中
 
2.     判断 - 总结知识模型的数据
 
3.     预测 - 通过知识模型给出一些输入来推导合适的输出
 
4.     推理 - 通过知识模型给出一些输出来推导合适的输入
 
它们都适用于一台计算机的优化过程。知识模型通常以图形表示,其中顶点是特征,边缘是相关性。
 
“白杨”(Poplar)
 
Graphcore使用名为“白杨”(Poplar)的C ++框架来处理IPU加速平台。它旨在为流行的机器学习框架(包括MXNet和Tensorflow)提供无缝接口,因此IPU与现有的应用程序相兼容。
 
“白杨”图形框架由一整套驱动程序、应用程序库、用于优化性能的分析/调试工具以及用于开发应用程序的Python和C ++接口组成。
 
“白杨”包装了一个从头开发的图编译器,可以将机器学习框架使用的标准操作转换为IPU的优化应用程序代码。它创建了一个图表的中介码,以便在多个IPU上部署。而且,编译器是能够显示这个图形的,所以在机器学习框架上编写的代码会显示成在IPU上运行的图形的图像。
 
编译器已经将网络描述转换成约1870万个顶点和11580万个边缘的计算图,这代表了一个名为AlexNet的强大的深度神经网络,作为IPU的执行计划。顶点与进程计算相关联,边源代表进程之间的通信。

\
 
IPU等图形处理器专为创建和执行各种深度学习模型的计算图网络而设计。我们都知道机器学习是计算的未来,而Graphcore则承诺类似IPU的架构将进行下一波计算。
 
基准
 
批量大小决定数据项规模,需要在训练机器学习模型的同时与当前的一组参数并行处理。如图所示,IPU在根据在训练ResNet 50神经网络上时每秒图像的性能估计,以学习ImageNet数据集的图像分类。

\
 
该图表显示即使在批量较小的情况下也能显着提高性能。当IPU加速卡扩展到8的时候,使用批量大小为64。在任何情况下,使用IPU系统都会比现有技术显着提高性能。例如,在300瓦GPU加速器上获得的最佳性能是每秒580张左右。
 
长短期记忆模型(LSTM)推断
 
时间递归神经网络中的数据依赖性限制了并行能力以及每个数据的操作数量。IPU和”白杨”的库照顾这些限制。该图显示了与GPU相比不同延迟约束的单层LSTM网络性能。

\
 
生成式网络
 
下图显示了DeepVoice  生成算法与其他平台相比的性能  。实验考虑了两种性能指标。如果可以生成实时数据流,样本生成速度决定了一次生成多少个音频通道。

\\
 
资金
 
近一年来,该公司已经筹集了3轮资金,约1.1亿美元。最近,2017年11月12日,Graphcore与红杉资本(Sequoia Capital)结束了5000万美元的C轮融资,这家并不知名的公司在欧洲进行大规模投资。这是Graphcore在之前的融资中已经筹集的6000万美元。
 
他们的其他投资者包括 Samsung, Bosch, Atomico, Dell Technologies Capital, DraperEsprit, Amadeus Capital, Foundation Capital 和 4 Ventures。首席执行官Nigel Toon表示,他们将利用这笔资金扩大生产规模,吸引更多的开发者加入平台,并花时间向潜在客户了解他们的产品是否解决了真正的问题。
 
竞争对手
 
毫无疑问,英伟达和英特尔正在这个市场上提出强烈的要求,同时他们利用数十年的经验和巨大的资金投入研发和市场营销。事实上,他们已经变成了几乎所有硬件的庞大提供商,从游戏和机器学习到加密货币挖矿机。
 
苹果在A11仿生芯片中有自己的硬件,谷歌有张量处理器能与TensorFlow很好地搭配。然后有报道 说,特斯拉可能会与AMD合作,为自驾车开发自己的AI芯片。他们都是巨头,但是考虑到市场机会,像Graphcore这样的AI创业公司似乎已成长到可以追赶这些巨头。
 
-END-


上一篇:传统编程遇上机器学习会擦出怎样的火花
下一篇:主流机器学习算法简介与其优缺点分析
精选推荐
研究人员融合人类与AI的创造力 显著提高了深度学习的表现
研究人员融合人类与AI的创造力 显著提高了深度学习的表现

[2019-10-12]  由加拿大人工智能领域研究主席、滑铁卢大学系统设计工程教授Alexander Wong领导的一个团队开发了一种新型紧凑型神经网络家族,可以在智能 ...

谷歌《Nature》发论文称实现量子霸权 18亿倍速碾压世界最强超算
谷歌《Nature》发论文称实现量子霸权 18亿倍速碾压世界最强超算

[2019-10-23]  谷歌坚称自己已经取得了量子霸权——这标志着计算研究领域的一个重要里程碑。谷歌首次发布声明是在今年9月,虽然遭到竞争对手的质疑,但就 ...

机器人灵巧手将成为智能机器人的下一个重大突破
机器人灵巧手将成为智能机器人的下一个重大突破

[2018-01-25]  计算机科学教授兼东北地区助手机器人实验室负责人罗伯特·普拉特(Robert Platt)说:“机器人手操作是下一步要解决的问题。想象一下,一个机器人可以在现实世界中用手去做事......

麻省理工正研究植物机器人 让植物自主控制机器人
麻省理工正研究植物机器人 让植物自主控制机器人

[2018-12-08]  控制论通常指人类用机器人部件增强自己。我们听说过动物机器人或昆虫机器人,但我们很少听说植物机器人对吧?一个机器人其实是对植物有很大益处的,因为一般植物根本无法移动......

可编辑神经网络,有望简化深度学习?
可编辑神经网络,有望简化深度学习?

[2019-10-04]  深度学习是一个计算繁重的过程。 降低成本一直是 Data curation 的一大挑战。 关于深度学习神经网络大功耗的训练过程,已经有研究人员 ...

人工神经网络技术解码人类行为和想象时的大脑活动信号
人工神经网络技术解码人类行为和想象时的大脑活动信号

[2017-08-23]  为搜索引擎过滤信息,棋盘游戏对弈,识别图像 人工智能在某些任务中远远超过了人类智能。来自弗莱堡由神经科学家私人讲师Tonio Ball博士领导的几个杰出的BrainLinks-Bra......

Crossbar将电阻式RAM推入嵌入式AI
Crossbar将电阻式RAM推入嵌入式AI

[2018-05-17]  电阻RAM技术开发商Crossbar表示,它已与航空航天芯片制造商Microsemi达成协议,允许后者在未来的芯片中嵌入Crossbar的非易失性存储器。此举是在先进制造业节点的领先代工厂选......

什么是机器人学?机器人学简介
什么是机器人学?机器人学简介

[2017-12-14]  机器人学是工程学与科学的交叉学科,包括机械工程,电气工程,计算机科学等。机器人技术涉及机器人的设计、制造、操作和应用,以及用于控制、感官反馈和信息处理的计算机系统。...

本周栏目热点

顶级AI会议NIPS压轴2017(附PPT、视频、代码大汇总)

[2017-12-19]  NIPS,全称神经信息处理系统大会(Conference and Workshop on Neural Information Processing Systems),是一个关于机器学习和计算神经科学的国际会议。该会议固定在每年的12月举行...

机器学习选择深层模型的原因

[1970-01-01]   深度学习采用的模型为深层神经网络(Deep Neural Networks,DNN)模型,即包含多个隐藏层(Hidden Layer,也称隐含层)的神经网络(Ne ...

机器学习—自由编码器

[1970-01-01]   一种常见的深层模型是由自编码器(Auto-Encoder)构造的。自编码器可以利用一组无标签的训练数据{x(1), x(2), &hellip }(其中x(i)是一个n ...

【NIPS最佳论文出炉】冷扑大师能战胜AlphaZero吗?No(Science论文)

[2017-12-19]  拿下NIPS2017 最佳论文,登上Science,“冷扑大师”最近有点热。18日,两位作者,CMU博士生Noam Brown和Tuomas Sandholm教授在Reddit上回答问题。对“为什么不使用深度学习......

日本开发团队给机器人嵌入神经网络

[2016-08-18]    近日在日本国立科学博物馆展出的 机器人 Alter,可谓是目前世界上最为先进的机器人之一,因为它是一款嵌入了神经网络的机器人,来自日本 ...