当 AI 掌握「读心术」:DeepMind AI 已经学会相互理解
有时候,我们会觉得 Siri 或 Alexa 等数字助理非常令人失望,因为它们根本不懂我们人类。它们需要懂点被心理学家称为「心智理论」(theory of mind)的东西,搞清楚别人的信念和意图。最近,计算机科学家开发出了一种新的 AI,这种 AI 可以探测到其他计算机的「想法」,并预测它们的行动,这是机器之间以及机器与人之间灵活协作的第一步。
加州大学伯克利分校的发展心理学家 Alison Gopnik 表示,显然,要探索一个充满各种想法的世界,「掌握心智理论非常重要。」人在大约 4 岁的时候会了解到,他人的信念可能与现实不符,然后根据这个人的信念推断其接下来的行动。当前的计算机可以区分「开心」、「生气」等面部表情,这是一种与「心智理论」相关的技能,但是它们对人类的情绪、动机知之甚少。
这一新项目的初衷是尝试让人理解计算机。AI 使用的许多算法并不是完全由程序员完成的,而是依赖于机器在解决问题的过程中不断「学习」。计算机生成的解决方案通常是黑箱,由于算法过于复杂,人类往往难以理解。因此,DeepMind 研究科学家 Neil Rabinowitz 和他的同事创建了一个名为「ToMnet」的心智理论 AI,并使其观察其他 AI,看看它能否了解其他 AI 智能体的工作原理。
ToMnet 由三个神经网络组成,每个网络包含一些小的计算单元和从经验中学到的连接,与人类大脑类似。第一个网络根据其他 AI 过去的行动学习它们的倾向。第二个网络理解其他 AI 的当前「信念」;第三个网络接收前两个网络的输出,并根据情况推测其他 AI 的后续行动。
研究中涉及的 AI 智能体是在虚拟房间中到处移动收集彩色箱子以获取得分的简单「角色」。ToMnet 从上方观察整个房间。一次测试中有三种「角色」:一种看不到周围环境,一种记不住最近的步伐,一种可以看到也可以记住。看不到的智能体可能会沿着墙走,「失忆」智能体会移动到离它最近的物体处,而第三种能够构建子目标,以特定顺序有策略地抓取物体,得到更多分。DeepMind 研究人员在本月于瑞典斯德哥尔摩举办的 ICML 大会上报告称:经过一番训练,ToMnet 不仅能够在几步之后识别「角色」的种类,还能够准确预测它们的未来行为。
最终测试证明,ToMnet 甚至可以理解持有错误信念的「角色」,这是训练它们掌握心智理论(人类和其他动物具备的心智理论)的关键阶段。在该测试中,一种「角色」被编程设定为近视,那么当计算机在游戏中途改变道路(超出上述「角色」的视力范围)时,ToMnet 可以准确预测到,近视的「角色」更可能坚持原来的路径,而视力好的「角色」则更倾向于调整路径,适应新的情况。
Gopnik 称,该研究以及 ICML 会议上证明 AI 可以根据它们对自己的了解预测其他 AI 智能体行为的另一研究,都是神经网络「惊人」自主学习能力的例证。但是这仍然无法使人工智能体达到人类儿童的同等水平,Gopnik 说道,AI 智能体很可能以接近完美的准确率完成错误信念任务,即使它们之前从未遇到过。
MIT 心理学家、计算机科学家 Josh Tenenbaum 也研究心智理论的计算模型。他认为 ToMnet 在推断信念方面比他团队研发出的系统更高效,后者基于更抽象的概率推论,而不是神经网络。但是 ToMnet 的理解能力与训练所用语境相关性更强,因此它在全新环境中预测行为的能力欠佳,而 Josh Tenenbaum 的系统甚至儿童在这方面做得更好。Josh 称,未来两种方法结合或许会给该领域带来「真正有趣的方向」。
Gopnik 注意到这种具备社交能力的计算机不仅将改善人机合作,还会影响到人机之间的相互「欺骗」。如果一台计算机能够理解错误信念,那它就可能知道如何诱导人类相信它。希望未来的扑克机器人能够掌握 bluff(使诈)的艺术。
论文:Machine Theory of Mind
论文链接:https://arxiv.org/abs/1802.07740
摘要:心智理论(ToM; Premack & Woodruff, 1978)广义上指个体有能力理解他人的心理状态,包括期望、信念和意图。我们提出对机器进行训练,使之也具备这项能力。我们设计了一种心智理论神经网络 ToMnet,它使用元学习通过观察智能体的行为而对它们进行建模。通过该过程,该网络得到一个对智能体行为具备强大先验知识的模型,同时能够利用少量行为观测对智能体特征和心理状态进行更丰富的预测。我们将 ToMnet 应用于在 gridworld 环境中采取行动的智能体,结果表明该网络学会对来自不同群体的智能体进行建模,包括随机、规则系统和深度强化学习智能体等,该网络通过了经典的 ToM 任务,如"Sally-Anne"测试,即意识到他人持有的错误信念。我们认为该系统(自动学习如何对出现在其世界中的其他智能体进行建模)是开发多智能体 AI 系统的重要步骤,可以帮助构建人机交互的中介技术,推进可解释性 AI 的发展。
原文发布时间为:2018-07-30
本文作者:Matthew Hutson
本文来自云栖社区合作伙伴“ CDA数据分析师”,了解相关信息可以关注“ CDA数据分析师”
当 AI 掌握「读心术」:DeepMind AI 已经学会相互理解相关推荐
- AI版「按图索骥」,比猜画小歌更复杂的的AI交互游戏
郑集杨 发自 凹非寺 量子位 报道 | 公众号 QbitAI 你能在时间结束前根据Emoji找到你身边的物品吗?大概,像这样: 跟我玩?不不不,是你自己跟这个AI玩,找出东西然后让AI辨认它. 这并 ...
- AI 复活「她」! GPT-3 帮美国小哥复刻逝去未婚妻,但又夺走她……
整理 | 禾木木 出品 | AI科技大本营(ID:rgznai100) 今年 7 月,一名33岁的美国小哥 Joshua Barbeau 在未婚妻去世后,根据她在 Facebook 和 twitter ...
- 一个「菜鸟」转行AI的成长心得!
↑↑↑关注后"星标"Datawhale 每日干货 & 每月组队学习,不错过 Datawhale干货 作者:太子长琴,算法工程师 本文是一个转行四年的「菜鸟」的成长心得,围绕 ...
- 马斯克:我有一个大胆的想法!给红绿灯加个AI视觉「外挂」
转载自:视学算法 编辑:好困 [导读]大半夜的,四下无人又没车,为何还要我等这么久的红灯?这两天,马斯克也在思考这个问题. 对于社畜来说,大城市的交通无非分为两种: 白天不让上班:晚上不让回家 ...
- OpenAI教GPT-3学会上网,「全知全能」的AI模型上线了
视学算法报道 编辑:陈萍 它被命名为 WebGPT,OpenAI 认为浏览网页的方式提高了 AI 解答问题的准确性. 如果 AI 学会上网,那么它就拥有了无限获取知识的方式,之后会发生什么就不太好预测 ...
- MIT人工智能实验室推出「液态」神经网络 | AI日报
带臂机器狗来了,捡垃圾.跳大绳.种花.写字,波士顿动力Spot迎来重大升级 今天,波士顿动力发布了Spot机器人全新视频,除了添加了一条机械臂,它还能实现捡垃圾.跳绳.种花等多种功能. Spot机器狗 ...
- AI复活「她」!用GPT-3复刻逝去未婚妻,美国小哥让挚爱以数字形态永生
转载自:新智元 「死亡不是真正的逝去,遗忘才是永恒的消亡.」 即便逝去,也不要遗忘. 近日,一位美国男子 Joshua Barbeau 在未婚妻去世后,重建了一个AI聊天机器人以复刻死去的未婚妻. J ...
- GPT-5将死于GPT-4背刺?牛津剑桥研究警告:AI训AI成「剧毒」,会让模型崩溃!
[导读]最差的人类语料,也要胜过AI生成的文本. 随着GPT-4.Stable Diffusion和Midjourney的爆火,越来越多的人开始在工作和生活中引入生成式AI技术. 甚至,有人已经开始尝 ...
- AI版「女娲」来了!文字生成图像、视频,8类任务一个模型搞定
来源丨机器之心 作者丨陈萍.小舟 AI会是未来的「造物者」吗? 近来,视觉合成任务备受关注.几天前英伟达的 GauGAN 刚刚上新了 2.0 版本,现在一个新视觉合成模型 Nüwa(女娲)也火了. 相 ...
最新文章
- 激光雷达 win10
- 分布式数据库切分规则介绍
- docker-compose 1.29.2 下载地址
- string基本字符系列容器
- ghelper怎么在手机上用_当长时间不用手机玩《崩坏3》、《战双》
- 关于vh和 calc
- forms Build中的触发器
- Myeclipse的web项目移植到Eclipse中需要添加的包
- android 向下动画,使用向上/向下滑动动画显示和隐藏视图
- android动画实现单摆效果
- linux学习笔记——创建软连接
- 全国计算机等级考试三级数据库技术(十)
- 强智教务php,强智科技教务处模拟登录
- PHP语法基础篇——除法取整和取余数
- tcl语言读取文件一行_tcl读取数据输入输出
- jquery 学习笔记及小练习
- Quartus Primer 17.0 下载和安装
- 【Java】进制转换
- linux cut命令
- 百变红茶的10种搭配喝法