爱吧机器人网 » 技术 > 机器学习 > 正文

无监督学习、GAN和强化学习将构建机器学习的未来

   随着人工智能的不断发展,许多新的机器学习技术、架构和算法被提出,但这里有三个宏观趋势,将成为机器学习中,游戏规则的改变者。
 
    机器学习(ML),特别是深度学习(DL)已经成为许多科技出版物所涵盖的最热门话题之一。当然,这里面有一些炒作的成份,但是我们有足够好的理由相信,机器学习这一领域是值得关注和覆盖的。
 
    机器学习的范围和影响一遍又一遍地在各种学科,数百种应用中被证明其重要性。广告、无人驾驶、聊天机器人、网络安全、无人机、电子商务、金融技术、工业机械、医疗保健、营销策划、机器人,以及搜索引擎等应用,只是机器学习的部分应用而已。
 
    机器学习的优势不再受限于只有少数几个能够买得起花哨装备的精英人士。不可否认的是,智能产品推荐以及高性价比的聊天机器人已经在普通百姓中得到了普及。这还不要说很多尚未开发的领域等着我们去发掘。
 
    开发并部署机器学习的成本正快速下降。即使是最热衷于这种技术的怀疑论者,比如马斯克和霍金,也可以很容易地发现它的用途非常多,并从机器学习身上找到商业价值。
 
    根据几位机器学习、深度学习领域的知名专家,深度神经网络“表现得极其好”,即便他们可能也搞不清到底为什么。
 
    深度学习正在迅速演变,而且是在许多维度上的。很多新技术、新架构,以及新算法被提出,当然,每个新的想法都有其独特的价值。然而,在未来几年,三个主要的宏观趋势将改变真正的游戏规则。
 
    无监督学习(unsupervised learning)
 
    机器学习和深度学习中,最重要的宏观趋势是算法正在逐步从监督学习模式转变为无监督学习模式。
 
    绝大多数传统机器学习的实现靠的是受监督的学习方式。换句话说,它们只有在使用大量标记的训练数据训练时才有用。虽然,受监督的学习方式效果不错,但是,收集和标记大型数据集的过程非常耗时、昂贵,而且还容易出错。当数据集的规模增加时,这些挑战变得更加显著。而另一方面,无监督的学习方式具有巨大的优势,因为他们不需要大量的训练数据集。这就解释了为什么最近大量有关机器学习的论文均与无监督学习有关。
 
    生成对抗网络(Generative adversarial networks,GANs)
 
    学习GAN的基本原理的前提是,你需要理解生成式和辨别式模型之间的差异。辨别式模型是使用标记的历史数据进行训练,并使用其累积的知识来推断,预测或分类的模型。
 
    以识别各种汽车的品牌和型号的图像识别模型为例。这样的模型通常由一组预先识别的汽车图像训练,同时学习将各种特征(例如尺寸、高度、尺寸和比率等)与特定品牌和模型相关联。一旦被训练,该模型会分析新的未标记的图像,并将其与特定的汽车品牌相关联。
 
    生成式模型的工作原理则不同,它的模式是,在训练期间,获得的积累的数据,来合成或产生新的结果。还是以汽车为例,生成模型的任务是创建一个全新的汽车概念之后,通过未标记的数据集(未识别的各种汽车的图像)进行训练。生成模型使用训练图像来了解汽车类别(例如跑车、SUV和轿车)的独特特征,并使用数据给出该通用类别特征的新汽车概念。更准确地说,一个训练有素的生成式模型不会用类似跑车的前端生成一个卡车的概念。
 
    那么,什么是生成式对抗网络(GAN)?未来它们会如何?其实,GANs已经不是一个新的模型类别了,他们只是用来训练一个生成模型的一种非常聪明和有效的方法。这种强度减少了对大型训练数据集的需求。
 
    GAN通常使用相互充当对手的两个神经网络来构造。一个生成非常类似于有效样本的假样本,而另一个网络(鉴别器)则接收与来自发生器的偶然错误样本混合的训练样本流,并将其区分开。这两个网络都是基于他们的对手的性能进行训练,在相互fooling的过程中变得越来越好。这个迭代过程的最终结果是,整体而言,模型被更好地训练,而且,更重要的是,通过最少的外部干预实现了对模型的改进。
 
    强化学习(Reinforcement learning,RL)
 
    强化学习原则上是通过实验和探索的方式学习。这与监督学习的范例大相径庭,因为后者依赖于已知的良好的训练数据,而强化学习开始时几乎不知道“世界是如何工作”。强化学习基于三个基本要素——“状态”、“行动”和“奖励”。
 
    举例来说,假设有一家毛衣电商,他们想使用强化学习算法,来说服游客购买他们的产品。我们来看看“状态”、“行动”和“奖励”是如何工作的。一个独特的“状态”,可以是一个潜在的加拿大访客,花了两分钟挑选一件毛衣的各种颜色,并已阅读该产品的两个评论;“行动”则是指,商家说服潜在顾客进行购买会采取的步骤(例如提供即时折扣,或显示穿着类似毛衣的名人的照片)。在某个“状态”中应用“行动”会导致到新“状态”的转换。在每次转换之后,基于进行销售的概率的增加(或减少)来“奖励”(或惩罚)强化学习算法。这里的关键是,强化学习算法最初对此毫不知情,但随着时间的推移,他们会学习选择在特定的“状态”(人口、环境和偏好)下完成最佳的策略(动作序列)。
 
    为什么说强化学习非常重要?主要有两个原因。首先,它们在诸如机器人、广告和游戏的各种应用中产生了显着的结果。更重要的是,强化学习可以很好地模仿人类从婴儿到成年的大脑的学习过程。
 
    这种飞跃使机器智能更接近人类智能,使机器能够应用更多技能,比如感觉和直觉的学习。

上一篇:谷歌发布深度学习库TensorFlow Fold,支持动态计算图
下一篇:深入浅出Tensorflow(一):深度学习及TensorFlow简介
精选推荐
美国Natilus公司试飞水上无人货机 设计简单成本降低
美国Natilus公司试飞水上无人货机 设计简单成本降低

[2017-12-28]  Natilus创业公司成立于2014年,其梦想是建造大型无人机,以半价提供比船舶快得多国际货运。在十二月份,Natilus计划在旧金山湾测试一个9米翼展的小型原型无人机的水上滑行能力......

通过对抗性图像黑入大脑
通过对抗性图像黑入大脑

[2018-03-02]  在上面的图片中,左边是一张猫的照片。在右边,你能分辨出它是同一只猫的图片,还是一张看起来相似的狗的图片?这两张图片之间的区别在于, ...

改变保险市场的格局:无人机如何通过更快的估算、响应时间和利益交付来使消费者受益
改变保险市场的格局:无人机如何通过更快的估算、响应时间和利益交付来

[2018-12-08]  市场研究公司IHS Markit预测,到2020年,专业无人机市场将通过农业,能源和建筑等行业利用测量,制图,规划等技术实现77 1%的复合年增长率(CAGR)。与此同时,消费者无人......

搭载人工智能的太空机器人CIMON 2乘SpaceX抵达国际空间站
搭载人工智能的太空机器人CIMON 2乘SpaceX抵达国际空间站

[2019-12-09]  12月5日,搭载人工智能的太空机器人西蒙2号(CIMON 2)乘坐SpaceX火箭Dragon货运舱,从佛罗里达州卡纳维拉尔角空军基地升空,前往国际空间 ...

亚马逊CEO杰夫·贝佐斯操控巨型有人驾驶机器人(巨型机甲)
亚马逊CEO杰夫·贝佐斯操控巨型有人驾驶机器人(巨型机甲)

[2017-03-21]  近日,亚马逊CEO杰夫·贝佐斯实现了每一个6岁儿童都会有的梦想,他控制了一个巨大的机甲机器人。据国外媒体Verge报道,前天(3月19日),贝 ...

7种常见的机器人焊接类型
7种常见的机器人焊接类型

[2017-12-17]  机器人焊接是工业领域最常见的机器人应用之一,近几十年来主要由汽车行业驱动。机器人焊接在完成大批量,重复性的焊接任务时效率最高。...

比利时研发出可以自我愈合伤口的软体机器人
比利时研发出可以自我愈合伤口的软体机器人

[2017-09-03]  软体机器人是机器人技术的新兴领域; 他们“可以与人类相互作用,而不会杀死他们,并拿起像西红柿这样柔软的物体。” 从长远来看,布鲁塞尔大学队伍正在努力创建一个类似的材......

可编辑神经网络,有望简化深度学习?
可编辑神经网络,有望简化深度学习?

[2019-10-04]  深度学习是一个计算繁重的过程。 降低成本一直是 Data curation 的一大挑战。 关于深度学习神经网络大功耗的训练过程,已经有研究人员 ...

本周栏目热点

顶级AI会议NIPS压轴2017(附PPT、视频、代码大汇总)

[2017-12-19]  NIPS,全称神经信息处理系统大会(Conference and Workshop on Neural Information Processing Systems),是一个关于机器学习和计算神经科学的国际会议。该会议固定在每年的12月举行...

机器学习选择深层模型的原因

[1970-01-01]   深度学习采用的模型为深层神经网络(Deep Neural Networks,DNN)模型,即包含多个隐藏层(Hidden Layer,也称隐含层)的神经网络(Ne ...

机器学习—自由编码器

[1970-01-01]   一种常见的深层模型是由自编码器(Auto-Encoder)构造的。自编码器可以利用一组无标签的训练数据{x(1), x(2), &hellip }(其中x(i)是一个n ...

【NIPS最佳论文出炉】冷扑大师能战胜AlphaZero吗?No(Science论文)

[2017-12-19]  拿下NIPS2017 最佳论文,登上Science,“冷扑大师”最近有点热。18日,两位作者,CMU博士生Noam Brown和Tuomas Sandholm教授在Reddit上回答问题。对“为什么不使用深度学习......

日本开发团队给机器人嵌入神经网络

[2016-08-18]    近日在日本国立科学博物馆展出的 机器人 Alter,可谓是目前世界上最为先进的机器人之一,因为它是一款嵌入了神经网络的机器人,来自日本 ...