爱吧机器人网 » 专题 > 观点 > 正文

详解谷歌AI五大安全机制论文 AI开发有多少坑?

仔细看完这些条件会让人感慨现在AI的愚蠢却又诧异它那诡异的“智慧”。或许构建一个AI系统是世界上对逻辑性要求最严密的职业了,因为正是逻辑造就了AI,在它们的世界里现在还不存在感情之类的约束。如果你要求AI去完成一件事,那AI毫无疑问的会在它的逻辑框架下想尽一切办法去完成,哪怕因此必须要完成一些在人类看来是“作弊”或者“得不偿失”的动作。

因此整篇论文的关键点就围绕在奖励条件的建立和维护上进行。正如之前所说,论文中并没有涉及过多的具体方法和公式,而倾向于提供思路,一部分原因应该是RL的研究实际上还不足以支撑在这些措施的太过具体的实现,不过在某种程度上应该也是因为谷歌不希望太具体的方法限制了 算法 开发者们的发挥。

防范的思路

对应这五点可能的错误,谷歌在论文中零零总总列出了大概十条防范措施的思路,不过总结起来,大致就是从三个RL设计的三个最基本的方面来考虑的:

对于奖励条件本身的优化:

人类的行动都是基于常识和道德来考虑的,因此,为机器也加上一个类似的价值观系统是一个比较合理的考虑方向,谷歌在论文里提出:指派RL 算法 完成任务的时候,人们最倾向的希望其实是该 机器人 不要给环境造成任何影响——不要破坏环境中已有的物品,不要打翻花瓶,不要……。但是如果只是简单粗暴的给所有对环境的改变都加上负奖励,那很可能会导致代理最终决定不再做任何事,因为一旦代理开始行动,或多或少都会给环境带来改变。

谷歌对此提出了几种思路,包括推测一个代理用正确的方式完成任务后环境的状态,然后用这个状态作为奖励、对代理进入完成任务时不希望其进入的区域的行为作出惩罚,以及让代理能够理解它的行为对其他代理个体(包括人)带来的影响,但谷歌在论文里也指出,目前并没有足够强大的能支持这种理解的模型出现。

防止对奖励条件的滥用和曲解:

对于这个方面,谷歌提出的方法大概能分为这么几类:

谨慎行动:这是最笨的办法,只要人们设计系统的时候够小心,可能就能避开所有能被 算法 利用来获取奖励的bug。或者从另一方面来说,人们可以故意留出一些可以被 算法 利用的漏洞来作为预警,并时刻监视这些漏洞,当这些漏洞被攻破,就意味着 算法 需要调整了。

相关搜索(Beta) 谷歌AI AI开发 详解可可的五大功能 五大联赛派系详解 五大发展理念详解 ai工具详解 java反射机制详解 handler机制详解 熔断机制详解 谷歌ai围棋 谷歌ai对弈李世石 谷歌ai是什么 谷歌 ai 谷歌ai大战李世石 谷歌ai三战李世石 谷歌ai围棋直播 李世石对战谷歌ai

上一页12345下一页

上一篇:微软押宝人工智能,原因何在?
下一篇:微软为何要豪赌AI?纳德拉想让公司超越谷歌
精选推荐
美国普渡大学研发快动作软体机器人,灵感来自变色龙舌头捕食
美国普渡大学研发快动作软体机器人,灵感来自变色龙舌头捕食

[2019-10-31]  本文图片均来自:Ramses v Martinez 普渡大学变色龙、蝾螈和许多蟾蜍利用积蓄的弹性能量,向距离1 5倍体长的毫无防备的昆虫伸出粘糊糊的舌 ...

机器人从工业走向家庭  库卡KUKA目标是引领中国市场
机器人从工业走向家庭 库卡KUKA目标是引领中国市场

[2017-12-08]  机器人正在改变着人们的生活方式,而库卡KUKA想要在中国这个大蛋糕中占有一块大份额,库卡公司正在引领市场...

新型轻便机器人套装重5kg,辅助跑步和步行
新型轻便机器人套装重5kg,辅助跑步和步行

[2019-10-23]  虽然步行对大多数人来说似乎不是负担,但对有些人来说,这项简单的运动往往会让人感到筋疲力尽。比如手术或中风后恢复的患者、帕金森氏症患 ...

瑞士研发出微型机器人集群 可像蚂蚁一样互相交流并协同工作
瑞士研发出微型机器人集群 可像蚂蚁一样互相交流并协同工作

[2019-07-12]  EPFL(瑞士联邦理工学院)的研究人员受到了蚂蚁的启发,开发了一款仅有10克重的小型机器人:他们可以相互交流,分配角色并完成复杂的任务。 ...

机器人iCub作为嵌入式AI的标准机器人研究平台的重要性
机器人iCub作为嵌入式AI的标准机器人研究平台的重要性

[2017-12-24]  机器人的研究在过去10年中得益于一个具有嵌入式人工智能(AI)的标准化开源平台——人形机器人iCub。iCub最初在意大利被创建,如今在欧洲、美国、韩国、新加坡和日本的实验室......

亚马逊计划建一个4000万美元的机器人中心
亚马逊计划建一个4000万美元的机器人中心

[2019-11-07]  爱吧机器人网消息,亚马逊11月6日宣布了一项计划,计划在美国马萨诸塞州韦斯特伯勒建立一个4000万美元、35万平方英尺的机器人创新中心。新 ...

一个让深度学习惨败的通用人工智能领域——语境处理
一个让深度学习惨败的通用人工智能领域——语境处理

[2019-11-04]  Context是指用来解释一段给定文本或语句的来源框架,我们可以翻译为上下文或语境。维基百科将context定义为:*在符号学、语言学、社会学和 ...

深度神经网络揭示了大脑喜欢看什么
深度神经网络揭示了大脑喜欢看什么

[2019-11-06]  爱吧机器人网编者按:近日,《自然-神经科学》发表了一篇论文,研究人员创建了一种深度人工神经网络,能够准确预测生物大脑对视觉刺激所产 ...

本周栏目热点

2017年聊天机器人未达到行业预期的3个原因

[2018-01-18]  持续几年的“聊天机器人革命”带来了巨大的期望。营销人员和未来主义者幻想着智能虚拟自主代理人,他们会比我们更好地了解我们自己,从谈话片段中收集我们的愿望,并将我们的......

【浅析】人工智能关键技术决定机器人未来

[2016-02-15]     目前的机器人已经能够胜任精确、重复性的工作,但很多时候,它还不能够灵活 ...

比尔·盖茨:AI是把双刃剑 应用来改善教育医疗

[2019-03-19]  比尔·盖茨表示,在医疗领域人工智能曾用于过滤23andMe的基因数据,发现硒元素的缺乏或可与非洲的早产现象有关。在18个月后,我们可以了解到,该项目是否会给2万多名带来更多......

深兰科技方林博士:人工智能自主进化成为可能

[2018-12-07]  人工智能行业在国内迎来集中研究兴盛期,研究侧重点也从观点提出期,发展到了以谷歌Alpha Go和深兰Deepblue Go为代表的机器学习、深度学习独立研究期,并在智能语音识别交互......

[2016-01-14]     1月12日,重庆市委书记孙政才在科研机构、企业和产业园区调研时强调,要深 ...