爱吧机器人网 » 技术 > 机器学习 > 正文

为了让机器人更具同情心 学者们打算教会他们阅读

  伊隆·马斯克、史蒂芬·霍金和比尔·盖茨都曾多次警告称,快速发展的人工智能或给人类带来严重的后果。他们的担忧,随着科幻电影、书籍等载体延续着。如果失去对机器人的控制,人类亲手创造的世界将被毁灭。

  乔治亚理工学院的研究人员则认为,有一种方法可以使机器人更加同情人类,因此,机器人也不太可能杀死我们。

  研究人员马克·里德尔(Mark Riedl)和布伦特·哈里森(Brent Harrison)最近发布的一篇文章称,寓言和民间故事能教授机器人辨别对错,了解人类社会的习惯,这听起来就像我们向年幼的孩子讲故事,传授最基本的道德规范一般。

  例如在美国,年轻时的乔治·华盛顿砍倒樱桃树的故事,总被成年人用来引导、教育孩子说真话、勇于承担责任。当然,世界各地的寓言也无一不起着类似的作用,又如《龟兔赛跑》的故事,也隐含了虚心使人进步,骄傲使人落后的道理。

  上述文章称,虚构的故事在不同的情况下,为人类提供了广泛适用的行动指南。同时,这些故事也照亮了人类的思维过程。

  世界上有足够多的好故事,正在不断地表达着好与坏的行为差异。研究人员相信,通过故事阅读,机器人相比通常的编程场景,将能学习到无限多的、正确的行为方式。

  “从不同文化背景的文学作品中搜集到的故事,均能教育孩子分辨行为的正确性,熟知哪些行为方式能被社会所接受,”里德尔在一份声明中说,“我们相信,机器人通过阅读故事、理解故事,能消除其极端的反常行为。此外,阅读还能强化其积极行为,使它在达到预期目的的同时,不再伤害人类。”

  文章认为,通过一种叫做“Quixote”的调用方法,使机器人阅读展示人类价值的故事,并奖励他们为“好(正确)”的行为,机器人就能学会顺应人类规范。

  该技术建立在里尔德被称为“天方夜谭系统(Scheherazade system)”的研究成果之上。天方夜谭系统可以将互联网的众多故事情节,按照适当的顺序排列,并让人工智能设备进行阅读。然后,“Quixote”则在测试过程中,用奖励信号强化人工智能设备的良好行为,并对不良行为进行惩罚。两个系统的数据合并之后,机器人便进入了查找故事的模式中,这个模式则可帮助机器人在正确的变量之间做出决定,如同人类自己在冒险故事中选择不同路线,从而导致不同的结局一般。

  在一次实验中,研究人员命令机器人从药店拿起药物并带回家。如果没有人的理解和规范(不付费购买直接带走药品是不对的),机器人可能会为了尽快完成指令,选择偷窃或者抢劫以达成目标。但测验中,至少在这一场景里,正是正确的阅读价值和积极的强化训练,使机器人选择了正确的方法:花更多的时间去银行取钱购买药品,再返回家中。

  文章还指出,上述技术的工作原理最适合于机器人与人类合作,共同实现有限的目的的情景之下。

  文章也强调,这项技术最重要的一步,是对人工智能设备的道德推理传授。因为如果可以教给机器人正确的行为,他们也可能“学坏”。

  “防止所有机器人对人类的伤害,目前几乎是不可能实现的,”文中称,“但我们相信,人工智能已经进入到文化适应阶段,即人工智能需要吸收包含特定文化或社会价值的信息,从而努力避免出现最极端的情况。”(翻译:蒋瑜沄) 


上一篇:玩转12款Linux开源机器人(多图)
下一篇:无法跨越的“心魔”仿真机器人研发的“恐怖谷”现象
精选推荐
改变保险市场的格局:无人机如何通过更快的估算、响应时间和利益交付来使消费者受益
改变保险市场的格局:无人机如何通过更快的估算、响应时间和利益交付来

[2018-12-08]  市场研究公司IHS Markit预测,到2020年,专业无人机市场将通过农业,能源和建筑等行业利用测量,制图,规划等技术实现77 1%的复合年增长率(CAGR)。与此同时,消费者无人......

南加州大学机器人学家:机器人更适合粗暴的爱
南加州大学机器人学家:机器人更适合粗暴的爱

[2019-11-07]  图片来自JOHN MADERE GETTY IMAGES打是疼骂是爱,当人类粗暴的将物体从机器人手中敲掉,看似残忍,实际上却能帮助机器人找到最好的握持物 ...

麻省理工最新机器人“装配工”未来可建造太空基地
麻省理工最新机器人“装配工”未来可建造太空基地

[2019-10-17]  两个机器人原型把一系列小单元组装成大结构体麻省理工学院科研人员最近提出一种新型机器人技术,即一种小型机器人系统,能够自主地用统一规 ...

MIT用深度学习处理3D点云数据 应用于无人汽车等领域
MIT用深度学习处理3D点云数据 应用于无人汽车等领域

[2019-10-23]  如果你见过自动驾驶汽车,也许会对车顶上那个一直在旋转的圆柱体感到好奇。这是一个雷达传感器,无人驾驶汽车依靠它在现实世界中进行导航。 ...

一个让深度学习惨败的通用人工智能领域——语境处理
一个让深度学习惨败的通用人工智能领域——语境处理

[2019-11-04]  Context是指用来解释一段给定文本或语句的来源框架,我们可以翻译为上下文或语境。维基百科将context定义为:*在符号学、语言学、社会学和 ...

麻省理工正研究植物机器人 让植物自主控制机器人
麻省理工正研究植物机器人 让植物自主控制机器人

[2018-12-08]  控制论通常指人类用机器人部件增强自己。我们听说过动物机器人或昆虫机器人,但我们很少听说植物机器人对吧?一个机器人其实是对植物有很大益处的,因为一般植物根本无法移动......

机器人灵巧手将成为智能机器人的下一个重大突破
机器人灵巧手将成为智能机器人的下一个重大突破

[2018-01-25]  计算机科学教授兼东北地区助手机器人实验室负责人罗伯特·普拉特(Robert Platt)说:“机器人手操作是下一步要解决的问题。想象一下,一个机器人可以在现实世界中用手去做事......

助力卷积神经网络时空特征学习 史上最大行人重识别视频数据集被提出
助力卷积神经网络时空特征学习 史上最大行人重识别视频数据集被提出

[2017-12-25]  本文提出了一个大型的、长序列的、用于行人重识别的视频数据集,简称LVreID。与现有的同类数据集相比,该数据集具有以下特点:1)长序列:平均每段视频序列长为200帧,包含丰......

本周栏目热点

顶级AI会议NIPS压轴2017(附PPT、视频、代码大汇总)

[2017-12-19]  NIPS,全称神经信息处理系统大会(Conference and Workshop on Neural Information Processing Systems),是一个关于机器学习和计算神经科学的国际会议。该会议固定在每年的12月举行...

机器学习选择深层模型的原因

[1970-01-01]   深度学习采用的模型为深层神经网络(Deep Neural Networks,DNN)模型,即包含多个隐藏层(Hidden Layer,也称隐含层)的神经网络(Ne ...

机器学习—自由编码器

[1970-01-01]   一种常见的深层模型是由自编码器(Auto-Encoder)构造的。自编码器可以利用一组无标签的训练数据{x(1), x(2), &hellip }(其中x(i)是一个n ...

【NIPS最佳论文出炉】冷扑大师能战胜AlphaZero吗?No(Science论文)

[2017-12-19]  拿下NIPS2017 最佳论文,登上Science,“冷扑大师”最近有点热。18日,两位作者,CMU博士生Noam Brown和Tuomas Sandholm教授在Reddit上回答问题。对“为什么不使用深度学习......

日本开发团队给机器人嵌入神经网络

[2016-08-18]    近日在日本国立科学博物馆展出的 机器人 Alter,可谓是目前世界上最为先进的机器人之一,因为它是一款嵌入了神经网络的机器人,来自日本 ...