近日,自然语言处理(NLP)领域的国际顶级学术会议“国际计算语言学协会年会”(ACL 2019)公布了今年大会论文录用结果。根据 ACL 2019 官方数据,今年大会的有效投稿数量达到 2694 篇,相比去年的 1544 篇增长高达 75%。其中,百度共有 10 篇论文被大会收录。

国际计算语言学协会(ACL,The Association for Computational Linguistics)成立于 1962 年,是自然语言处理领域影响力最大、最具活力的国际学术组织之一,自成立之日起就致力于推动计算语言学及自然语言处理相关研究的发展和国际学术交流。百度高级副总裁、AI 技术平台体系 (AIG) 和基础技术体系(TG)总负责人王海峰曾于 2013 年出任 ACL 主席,是 ACL 五十多年历史上首位华人主席,也是 ACL 亚太分会(AACL)的创始主席,ACL 会士。研究论文能够被 ACL 学术年会录用,意味着研究成果得到了国际学术界的认可。

百度被录用的 10 篇论文,覆盖了信息抽取、机器阅读理解、对话系统、视频语义理解、机器翻译等诸多 NLP 领域的热点和前沿研究方向,提出了包括基于注意力正则化的 ARNOR 框架(Attention Regularization based NOise Reduction)、语言表示与知识表示深度融合的 KT-NET 模型、多粒度跨模态注意力机制、基于端到端深度强化学习的共指解析方法等,在人机交互、智能客服、视频理解、机器翻译等场景中具有很大的应用价值。

附:百度被收录 ACL 2019 论文概览

ARNOR: Attention Regularization based Noise Reduction for Distant Supervision Relation Classification

摘要:远监督通过知识库自动获取标注语料,是关系抽取的关键算法。但是远监督通常会引入大量噪声数据,即句子并未表达自动标注的关系。进一步说,基于远监督学习的模型效果不佳、解释性差,无法解释关系的指示词。

为此,我们提出基于注意力正则化的 ARNOR 框架(Attention Regularization based NOise Reduction)。此方法通过注意力机制,要求模型能够关注关系的指示词,进而识别噪声数据,并通过 bootstrap 方法逐步选择出高质量的标注数据,改善模型效果。此方法在关系分类及降噪上均显著优于此前最好的增强学习算法。

应用价值:在文本信息抽取有广泛的应用价值。此方法能够显著降低对标注数据的依赖,实现低成本的基于知识库的自动关系学习,未来可落地在医疗、金融等行业信息抽取中。

Enhancing Pre-trained Language Representations with Rich Knowledge for Machine Reading Comprehension

摘要:机器阅读理解 (Machine Reading Comprehension) 是指让机器阅读文本,然后回答和阅读内容相关的问题。该技术可以使机器具备从文本数据中获取知识并回答问题的能力,是构建通用人工智能的关键技术之一,长期以来受到学术界和工业界的广泛关注。近两年,预训练语言表示模型在机器阅读理解任务上取得了突破性进展。通过在海量无标注文本数据上预训练足够深的网络结构,当前最先进的语言表示模型能够捕捉复杂的语言现象,更好地理解语言、回答问题。然而,正如大家所熟知的,真正意义上的阅读理解不仅要求机器具备语言理解的能力,还要求机器具备知识以支撑复杂的推理。为此,在论文《Enhancing Pre-trained Language Representations with Rich Knowledge for Machine Reading Comprehension》中,百度开创性地提出了语言表示与知识表示的深度融合模型 KT-NET,希望同时借助语言和知识的力量进一步提升机器阅读理解的效果。

KT-NET 的模型架构如下图所示。首先,针对给定的阅读内容和结构化知识图谱,分别利用语言表示模型和知识表示模型对两者进行编码,得到相应的文本表示和知识表示。接下来,利用注意力机制从知识图谱中自动筛选并整合与阅读内容高度相关的知识。最后,通过双层自注意力匹配,实现文本表示和知识表示的深度融合,提升答案边界预测的准确性。截止到发稿日,KT-NET 仍然是常识推理阅读理解数据集 ReCoRD 榜单上排名第一的模型,并在此前很长一段时期内都是 SQuAD 1.1 榜单上效果最好的单模型。

KT-NET: 语言表示与知识表示的深度融合模型

应用价值:该项技术可应用于搜索问答、智能音箱等产品中,直接精准定位用户输入问题的答案,并在搜索结果首条显著位置呈现或通过语音播报呈现给用户。

Know More about Each Other: Evolving Dialogue Strategy via Compound Assessment

摘要:现有的基于监督学习的对话系统,缺乏对多轮回复方向的控制和规划,通常导致对话中发生重复、发散等问题,使得用户的交互体验偏差。 在本文中,我们对多轮对话进行了复合评估 (compound assessment),并基于该评估利用强化学习优化两个自对话 (self-play) 的机器人,促进生成过程中较好地控制多轮对话的方向。考虑到对话的一个主要动机是进行有效的信息交换,针对 Persona Chat 问题(两个人相互对话聊兴趣爱好),我们设计了一个较为完善的评估系统,包括对话的信息量和连贯度两个主要方面。我们利用复合评估作为 reward,基于策略梯度算法 (policy gradient),指导优化两个同构的对话生成机器人之间的对话策略 (dialogue strategy)。该对话策略通过控制知识的选择来主导对话的流向。 我们公开数据集上进行了全面的实验,结果验证了我们提出的方法生成的多轮对话质量,显著超过其他最优方法。

应用价值:可应用于对话系统、智能客服。

Proactive Human-Machine Conversation with Explicit Conversation Goal

摘要:目前的人机对话还处于初级水平,机器大多是被动对话,无法像人类一样进行充分交互。我们提出了基于知识图谱的主动对话任务,让机器像人类一样主动和用户进行对话。对话过程中,机器根据知识图谱主动引领对话进程完成提前设定的话题 (实体) 转移目标,并保持对话的自然和流畅性。为此,我们在电影和娱乐任务领域人工标注 3 万组共 27 万个句子的主动对话语料,并实现了生成和检索的两个主动对话基线模型。

应用价值:可应用于智能音箱中的对话技能,也可以基于此开发闲聊技能,让机器主动发起基于知识图谱的聊天。

Multi-grained Attention with Object-level Grounding for Visual Question Answering

摘要:视觉问答 (VQA) 是一类跨模态信息理解任务,要求系统理解视觉图片信息,并回答围绕图片内容的文本问题。这篇文章提出一种多粒度跨模态注意力机制,在图片 - 句子粒度注意力的基础上,提出更细粒度的物体级别跨模态信息注意力机制,并给出 2 种有效的细粒度信息理解增强的方法。实验表明我们的方法有助于对复杂图像和细小物体的识别,使系统更准确地定位到回答文本问题所依赖的视觉信息,从而显著提升 VQA 准确率。

应用价值:可应用于基于多模态信息和知识图谱的小视频内容理解项目。

Hubless Nearest Neighbor Search for Bilingual Lexicon Induction

摘要:这项基础研究提出了一种提高最近邻搜索的方法。该方法有非常漂亮的理论基础,不仅能显著提升双语词典编纂(Bilingual Lexicon Induction)的准确率,对涉及最近邻搜索的很多任务都有指导意义。

应用价值:机器翻译需要大量对齐的双语文本作为训练数据。这一要求在某些情况下不能被满足,比如小语种文本,专业文献。双语词典编纂在这种情况下能提升翻译系统的准确率。

STACL: Simultaneous Translation with Implicit Anticipation and Controllable Latency

摘要:同声翻译是人工智能领域公认的最难问题之一,已经困扰学术界和工业界几十年了。我们提出了历史上第一个超前预测和可控延迟的同声翻译算法。去年 10 月发布以来,被各大技术外媒广泛报导,包括 MIT 技术评论、IEEE Spectrum、财富杂志等。量子位总结报道:“这是 2016 年百度 Deep Speech 2 发布以来,又一项让技术外媒们如此激动的新进展。”

应用价值:2018 年 11 月的百度世界大会采用了这项同传技术,全程同传翻译了 Robin 所有演讲,延迟仅为 3 秒左右,而之前的整句翻译技术延迟为一整句(可达 10 秒以上)。同时,翻译质量也没有明显的下降。

Simultaneous Translation with Flexible Policy via Restricted Imitation Learning

摘要:本文旨在提高同声翻译的质量。我们去年提出的 STACL 框架(即上述文章 7)虽然简单有效,但有时不够灵活。现在我们提出一种基于模仿学习的同声翻译算法,通过模仿本文设计的动态策略,该模型可以实时灵活地决定是否需要等待更多信息来继续翻译,进而在保持低延迟的情况下提高了翻译质量。

应用价值:该技术可用于同声传译系统。

Robust Neural Machine Translation with Joint Textual and Phonetic Embedding

摘要:该文章旨在提高翻译的鲁棒性,特别是对同音词噪音的鲁棒性。我们在翻译的输入端,通过联合嵌入的方式,加入输入单词对应的发音信息。实验结果表明,该方法不仅大大提高了翻译系统在噪声情况下的鲁棒性,也大幅提高了翻译系统在非噪声情况下的性能。

应用价值:可用于翻译,特别是语音到语音的同声传译系统。语音翻译的一个主要难题是语音识别的错误太多,而这些错误大多是同音词或发音相似的单词,此技术可以很大程度上降低这些来自于语音识别的噪音。

End-to-end Deep Reinforcement Learning Based Coreference Resolution

摘要:共指解析是信息抽取任务中不可或缺的组成部分。近期的基于端到端深度神经网络的方法,往往通过优化启发式的损失函数并做出一系列局部解析决策,缺乏对整个篇章的理解。本文首次提出了基于端到端深度强化学习的共指解析方法,在同一框架内完成指称检测和指称链接,并且直接优化共指解析的评价指标,在 OntoNotes 上取得了良好效果。

应用价值:知可用于识图谱构建,信息抽取。

精彩推荐

推荐阅读

  • 回顾 | 阿里达摩院、腾讯、滴滴、Hulu等公司大牛的机器学习专场分享

  • 找啊找啊找木偶,图灵奖得主G. Hinton第一篇论文曝光!

  • 10个爬虫工程师必备的工具了解一下

  • 太惨!这5种编程语言遭100W+程序员厌弃!网友:怀念青春.....

  • 技术引路:机器学习仍大有可为,但方向在哪里?

  • 如何快速深入理解监控知识? | 技术干货

  • 比特币冲到9000美元, 你就能找个好工作?

  • ARM 发布新一代 CPU 和 GPU,实现 20% 性能提升

  • 1000 万个“AI 名师”:用机器算法“解剖”应试教育

史上最大规模ACL大会放榜,百度10篇NLP论文被录用!相关推荐

  1. AAAI 2020放榜,8800篇提交论文创纪录,接收率20.6%

    机器之心报道 参与:李亚洲.泽南 一觉醒来,朋友圈刷屏的不只有双十一,AAAI 2020 大会也终于放榜了:在今年多达 8800 篇提交论文中,最终录取的数量为 1591 篇,接收率 20.6%,竞争 ...

  2. 鸿蒙开发者大会邀请函,将召开史上最大规模开发者大会,华为抓紧调试“鸿蒙”系统...

    据华为网站消息,华为近日发布了2019年开发者大会邀请函,本届开发者大会将于8月9日至8月11日于东莞松山湖举行.此次大会共分为主题演讲.技术论坛和Codelabs共三部分.本次开发者大会邀请了150 ...

  3. 英方软件科创板敲钟上市;亚马逊启动史上最大规模裁员;我国5G用户超全球平均水平2.75倍丨每日大事件...

    ‍ ‍数据智能产业创新服务媒体 --聚焦数智 · 改变商业 IPO 英方软件科创板敲钟上市 上海英方软件股份有限公司(简称"英方软件",688435.SH)于19日在上交所科创板上 ...

  4. 【云周刊】第146期:史上最大规模人机协同的双11,12位技术大V揭秘背后黑科技...

    摘要: 史上最大规模人机协同的双11,12位技术大V揭秘背后黑科技,INTERSPEECH 2017系列 | 语音识别之语言模型技术,机器学习初学者必须知道的十大算法,云数据库SQL Server 2 ...

  5. 史上最大规模,天猫新零售如何爆改100家大润发?

    阿里究竟能给大润发带来什么改变? 自从阿里巴巴集团224亿战略入股大润发母公司高鑫零售的消息披露,这就变成一个令人期待的问题.这是中国商业零售史上最大规模的新零售改造升级行动. 阿里巴巴集团CEO张勇 ...

  6. 华为史上最大规模升级!鸿蒙系统进度发布:近百款机型已适配

    自从HarmonyOS系统正式发布之后,华为就开始了史上最大规模的系统升级计划,覆盖面积非常广泛,号称是"百"机焕新计划,覆盖了许多老款机型,基本上存量的老用户都能体验到Harmo ...

  7. 史上最大规模的 PPS DDoS 攻击现身,欧洲某大型银行遭殃

     聚焦源代码安全,网罗国内外最新资讯! 编译:奇安信代码卫士团队 欧洲某银行遭大规模 DDoS 攻击,其网络遭遇每秒8.09亿数据包的洪水攻击. 该攻击可能是史上最大规模的 DDoS 攻击,尽管并非带 ...

  8. 史上最大规模世界杯直播 阿里云承包了全网70%的流量

    6月14日晚,2018年俄罗斯世界杯在莫斯科开幕.国内数千万的观众通过CCTV5.优酷.央视影音或者是咪咕视频观看了此次开幕赛.值得注意的是,这四大官方指定网络直播平台都选择了使用阿里云的技术,确保观 ...

  9. 揭秘:宜信科技中心如何支持公司史上最大规模全员远程办公|上篇

    疫情还在继续,大部分人已经开启为期一周,甚至更长时间的远程办公生涯.远程办公最重要的,是自我隔离可以有效防止疫情的传播.但远程办公,其实没有那么容易,作为一家金融科技旗舰企业,远程办公所面临的挑战不仅 ...

最新文章

  1. SAP CRM one order PERFORM read_header_ext的switch case分支
  2. 网站为什么 JS 调用尽量放到网页底部?
  3. csdn2020年度博客之星 - 直播间(恭喜圆满结束)
  4. 华为多臂路由_[分享]华为 AR路由 策略路由 多WAN环境下指定出口 | 霸王硬上弓's Blog...
  5. 自定义控件使用InnerDefaultProperty提示“内不允许包含文字内容”
  6. 温习SQL server
  7. python-常用模块-time、datetime模块
  8. 性能测试负载模型(八)
  9. 机房冷风吹-linux基础环境搭建(基础篇)
  10. 【知识点总结】电力拖动系统——交流调速系统
  11. NCTF-Writeup
  12. 人脸识别“抓”错了人,他在监狱待了10天
  13. ZZNU 2125:A + B 普拉斯(傻逼题+大数加法)
  14. /和/*的区别和用法
  15. 谷歌搜索的灵魂!BERT模型的崛起与荣耀
  16. 使用苹果的地图与定位
  17. 实例004:这天第几天 输入某年某月某日,判断这一天是这一年的第几天?
  18. 小游戏——扫雷(可以标记)
  19. 如何将文件夹中的图片名字提取到一个txt文档上
  20. DeFi热潮下的安全隐患:流动性危机恐将造成连锁反应 | 非正式会谈

热门文章

  1. Windows下Mysql主从配置(Mysql5.5)
  2. 解决Mysql:unrecognized service错误的方法(CentOS)附:修改用户名密码
  3. EBS form日历可选范围设置(calendar.setup )介绍
  4. fastJson结合Nutz.Mapl的进阶应用
  5. 如何使用好android的可访问性服务(Accessibility Services)
  6. 脚本化 tmux — LinuxTOY
  7. ABAP 一个隐藏 selection-screen block的实例
  8. ccc计算机比赛如何报名,整理:加拿大的CCC是什么,怎么报名?
  9. js 条件语句控制html,如何避免在JS脚本上过多使用 if 语句?(技巧分享)
  10. java json 长度限制_[原创]Java中字符串、数组、集合及JSONArray的长度属性