智能金融的基石——自然语言处理(NLP)和知识图谱

金融行业因其与数据的高度相关性,成为人工智能最先应用的行业之一,而自然语言处理(NLP)与知识图谱作为人工智能技术的重要研究方向与组成部分,正在快速进入金融领域,并日益成为智能金融的基石。

一般的金融科技公司只会集中在其中的某些业务方向,只要能深入掌握两到三种能力,就能具有相当的竞争力。在这些业务场景中,自然语言处理(NLP)和知识图谱技术往往需要共同应用,才能发挥出最大的效能。同时,一种核心能力可以在多个智能金融应用场景中得到应用,这些应用场景包括:智能投研、智能投顾、智能风控、智能客服、智能监管、智能运营等。

金融语义应用场景概念框 01智能问答和语义搜索 智能问答和语义搜索是自然语言处理(NLP)的关键技术,目的是让用户以自然语言形式提出问题,深入进行语义分析,以更好理解用户意图,快速准确获取知识库中的信息。在用户界面上,既可以表现为问答机器人的形式(智能问答),也可以为搜索引擎的形式(语义搜索)。智能问答系统一般包括问句理解、信息检索、答案生成三个环节。智能问答系统与金融知识图谱密切相关,知识图谱在语义层面提供知识的表示、存储和推理,智能问答则从语义层面提供知识检索的入口。基于知识图谱的智能问答相比基于文本的问答更能满足金融业务实际需求。 智能问答和语义搜索的价值在金融领域越来越被重视。它主要应用的场景包括智能投研、智能投顾和智能客服。在智能投研领域,投研人员日常工作需要通过多种渠道搜索大量相关信息。而有了金融问答和语义搜索的帮助,信息获取途径将是“Just ask a question”。并且,语义搜索返回的结果不仅是平面化的网页信息,而是能把各方面的相关信息组织起来的立体化信息,还能提供一定的分析预测结论。在智能客服和智能投顾领域,智能问答系统的应用主要是机器人客服。机器人客服目前的作用还只是辅助人工客服回答一些常见问题,但已能较大地节省客服部门的人力成本。 典型应用案例如美国Alphasense公司为投研人员整合碎片化信息,提供专业金融知识访问工具。AlphaSense公司的产品可以说是新一代的金融知识引擎。它从新闻、财报、研报各种行业网站等获取大量数据、信息、知识形式的“素材”,通过语义分析构建成知识图谱,并提供高级语义搜索引擎、智能问答、交互式知识管理系统、文档(知识)协作系统,以对金融知识进行更加有效的管理、搜索、使用。 02资讯与舆情分析 金融资讯信息非常丰富,例如公司新闻(公告、重要事件、财务状况等)、金融产品资料(股票、证券等)、宏观经济(通货膨胀、失业率等)、政策法规(宏观政策、税收政策等)、社交媒体评论等。 金融资讯每天产生的数量非常庞大,要从浩如烟海的资讯库中准确找到相关文章,还要阅读分析每篇重要内容,是费时费力的工作。如果有一个工具帮助人工快速迅捷获取资讯信息,将大大提高工作效率。资讯舆情分析的主要功能包括资讯分类标签(按公司、产品、行业、概念板块等)、情感正负面分析(文章、公司或产品的情感)、自动文摘(文章的主要内容)、资讯个性化推荐、舆情监测预警(热点热度、云图、负面预警等)。在这个场景中,金融知识图谱提供的金融知识有助于更好理解资讯内容,更准确地进行资讯舆情分析。 资讯舆情分析的应用主要在智能投研和智能监管这两个场景。目前市场上的辅助投研工具中,资讯舆情分析是必不可少的重要部分。资讯舆情分析作为通用工具更多是对海量定性数据进行摘要、归纳、缩简,以更加快捷方便地为投研人员提供信息,支持他们进行决策,而非直接给出决策结论。在智能监管领域,通过资讯舆情分析,对金融舆情进行监控,发现违规非法活动进行预警。 03金融预测和分析 基于语义的金融预测即利用金融文本中包含的信息预测各种金融市场波动,它是以NLP等人工智能技术与量化金融技术的结合。 利用金融文本数据帮助改善金融交易预测模型的想法早已有之。本世纪初,美国就有人利用新闻和股价的历史数据来预测股价波动。2010年后,社交媒体产生了大量数据,基于Twitter、Facebook来预测股市的研究项目很多。最近,深度学习被大量应用在预测模型中。金融文本数据提供的信息是定性的(qualitative),而通常数字形式的数据是定量的(quantitative)。定性分析比定量分析更难,定性信息包含的信息量更大。有分析表明,投资决策人员在进行决策时,更多依赖于新闻、事件甚至流言等定性信息,而非定量数据。因此,可期待基于语义的金融预测分析大有潜力可挖。这个场景中涉及的关键NLP技术包括事件抽取和情感分析技术。金融知识图谱在金融预测分析中具有重要的作用,它是进行事件推理的基础。例如在中兴事件中,可根据产业链图谱推导受影响的公司。 基于语义的金融预测和分析在金融应用的主要场景包括智能投研和智能投顾。它的理想目标是能代替投资人员做投资预测,进行自动交易,但目前还只是作为投资人员的投资参考。将不同来源的多维度数据进行关联分析,特别是对非结构化数据的分析,比如邮件、社交网络信息、网络日志信息。从而挖掘和展现出未知的相关关系,为决策提供依据。典型的应用案例如美国Palantir公司提供基于知识图谱的大数据分析平台。其金融领域产品Metropolis,通过整合多源异构数据,构建金融领域知识图谱。特点是:对非结构化数据的分析能力、将人的洞察和逻辑与高效的机器辅助手段相结合起来。另一个例子如Kensho公司利用金融知识图谱进行预测分析。在英国脱欧期间,交易员成功运用Kensho了解到退欧选举造成当地货币贬值;曾准确分析了美国总统任期的前100天内股票涨跌情况。 04文档信息抽取 信息抽取是NLP的一种基础技术,是NLP进一步进行数据挖掘分析的基础,也是知识图谱中知识抽取的基础。采用的方法包括基于规则模板的槽填充的方法、基于机器学习或深度学习的方法。按抽取内容分可以分为实体抽取、属性抽取、关系抽取、规则抽取、事件抽取等。 在这里的文档信息抽取特指一种金融应用场景。指从金融文档(如公告研报)等抽取指定的关键信息,如公司名称、人名、指标名称、数值等。文档格式可能是格式化文档(word, pdf, html等)或纯文本。对格式化文本进行抽取时需要处理并利用表格、标题等格式信息。文档信息抽取的应用场景主要是智能投研和智能数据,促进数据生产自动化或辅助人工进行数据生产、文档复核等。 05自动文档生成 自动文档生成指根据一定的数据来源自动产生各类金融文档。常见的需要生成的金融文档如信息披露公告(债券评级、股转书等)、各种研究报告。 自动报告生成属于生成型NLP应用。它的数据来源可能是结构化数据,也可能是从非结构化数据用信息抽取技术取得的,也可能是在金融预测分析场景中获得的结论。简单的报告生成方法是根据预定义的模板,把关键数据填充进去得到报告。进一步的自动报告生成需要比较深入的NLG技术,它可以把数据和分析结论转换成流畅的自然语言文本。 自动文档生成的应用场景包括智能投研、智能投顾等。它的典型应用案例如美国的Narrative Science,它从结构化数据中进行数据挖掘,并把结果用简短的文字或依据模板产生报告内容。又如Automated Insights,它为美联社自动写出了10亿多篇文章与报告。 06风险评估与反欺诈 风险评估是大数据、互联网时代的传统应用场景,应用时间较早,应用行业广泛。它是通过大数据、机器学习技术对用户行为数据分析后,进行用户画像,并进行信用和风险评估。 NLP技术在风控场景中的作用是理解分析相关文本内容,为待评估对象打标签,为风控模型增加更多的评估因子。引入知识图谱技术以后,可以通过人员关系图谱的分析,发现人员关系的不一致性或者短时间内变动较大,从而侦测欺诈行为。利用大数据风控技术,在事前能够预警,过滤掉带恶意欺诈目的人群;在事中进行监控,发生欺诈攻击时及时发现;在事后进行分析,挖掘到欺诈者的关联信息,降低以后的风险。 在金融行业,风险评估与反欺诈的应用场景首先是智能风控。利用NLP和知识图谱技术改善风险模型以减少模型风险,提高欺诈监测能力。其次,还可以应用在智能监管领域,以加强监管者和各部门的信息交流,跟踪合规需求变化。通过对通信、邮件、会议记录、电话的文本进行分析,发现不一致和欺诈文本。例如欺诈文本有些固定模式:如用负面情感词,减少第一人称使用等。通过有效的数据聚合分析可大大减少风险报告和审计过程的资源成本。从事此类业务的Finctech公司很多,如Palantir最初从事的金融业务就是反欺诈。其他如Digital Reasoning、Rapid Miner、Lexalytics、Prattle等。 07客户洞察 客户关系管理(CRM)也是在互联网和大数据时代中发展起来,市场相对成熟,应用比较广泛,许多Fintech公司都以此为主要业务方向。现代交易越来越多是在线上而不是线下当面完成,因此如何掌握客户兴趣和客户情绪,越来越需要通过对客户行为数据进行分析来完成。 NLP技术在客户关系管理中的应用,是通过把客户的文本类数据(客服反馈信息、社交媒体上的客户评价、客户调查反馈等)解析文本语义内涵,打上客户标签,建立用户画像。同时,结合知识图谱技术,通过建立客户关系图谱,以获得更好的客户洞察。这包括客户兴趣洞察(产品兴趣),以进行个性化产品推荐、精准营销等。以及客户态度洞察(对公司和服务满意度、改进意见等),以快速响应客户问题,改善客户体验,加强客户联系,提高客户忠诚度。 客户洞察在金融行业的应用场景主要包括智能客服和智能运营。例如在智能客服中,通过客户洞察分析,可以改善客户服务质量,实现智能质检。在智能运营(智能CRM)中,根据客户兴趣洞察,实现个性化精准营销。国外从事这个业务方向的Fintech公司很多,如Inmoment,Medallia,NetBase等。

自然语言处理(NLP)和知识图谱两种技术本身都还在发展成长过程中,因此在金融落地过程中势必也还会面临许多新的课题和挑战,任重而道远。一方面,人工智能必须与金融的具体业务场景切合,找到金融企业需求痛点,真正提升客户生产效率,给客户带来价值;另一方面,人工智能是基础技术学科,技术难度大,人才要求高,在核心技术和关键算法上需要有突破有优势,才能不断提升市场竞争力。所以,场景驱动和技术研发需要相辅相成、紧密结合。相信金融智能语义技术的应用将会有广阔的发展空间,推动智能金融迈向一个新的台阶。

转载于:https://www.cnblogs.com/zym1998/p/11039858.html

自然语言处理结合金融专业应用,主要在于资料搜集和处理。相关推荐

  1. 金融专业本科生毕业论文选题推荐?

    每年毕业季这个时候一个令人头秃的问题就来了:该如何选定毕业论文的题目,对于金融专业的学生们也不例外. 那本篇文章就来教你如何选题,毕竟只有选定好题目,接下来的论文撰写工作才能顺利的开展.毫不夸张的说, ...

  2. logistic回归 简介_金融专业进!逻辑回归模型简述

    逻辑回归模型 逻辑回归属于机器学习中的较为经典的模型,在很多金融专业的实证部分都会用到逻辑回归.接下来分成以下几个部分对逻辑回归模型进行介绍. 1. 模型简介 逻辑回归中的"逻辑" ...

  3. 上海计算机和金融专业,姚明:我将去上海交大读书 选择计算机金融专业

    北京时间2011年7月20日下午14时,姚明及其团队在上海召开新闻发布会,亲口宣布正式退役. 姚明终于离开了他深爱的火箭队,但他并不会离开球迷的视野.当你再见到这个来自东方的大个子的时候,他的角色已经 ...

  4. 352计算机调剂,今年考研金融专业352分能调剂吗?有机会调剂到哪些学校?

    一个参加了2018年考研的学子,报考的金融专业,考了352分,但目标学校是top级的名校,因此已经知道自己上不了第一志愿的学校了,现在考虑调剂,就问小编这个分数是否可以调剂,如果可以调剂,能调剂到哪些 ...

  5. 计算机金融专业课程方案,《计算机在金融业中的应用》教学实施方案

    一.教学性质与任务 该课程是中央广播电视大学经济类金融专业(开放教育专科)的一门必修课程.该课程在系统讲授计算机系统.操作系统.计算机网络和数据库的基本概念和原理,重点讲授了微机操作系统.文字处理软件 ...

  6. 金融统计分析python论文_比较好写的本科金融专业论文题目 本科金融专业论文题目怎么取...

    为论文写作提供[100道]比较好写的本科金融专业论文题目,海量本科金融专业相关论文题目,包括专科与本科以及硕士论文题目,解决您的本科金融专业论文题目怎么取的相关难题! 一.比较好写的本科金融专业论文题 ...

  7. 互联网金融和计算机哪个专业比较好,互联网金融专业就业方向及前景分析(解读)...

    高考志愿填报如何选择专业?怎样才能选到一个好的专业?选择专业是一件非常重要的事情,我们都知道高考志愿填报最后选择的专业跟我们有着很大的关系,一般不要出现任何问题的话几乎后半生都是要靠着这个专业谋生的, ...

  8. 清华计算机金融学,清华大学王牌专业排名 经济与金融专业上榜(10个)

    简介:清华大学是中国著名的大学,学校环境优美,教育实力雄厚.它有20所学院.58个系和78个本科专业.对于那些想考清华大学的学生来说,他们可能对清华大学的王牌专业更感兴趣.今天排名第一的是清华大学的王 ...

  9. 2022年中级经济师考试中级金融专业练习题及答案

    1.假定甲国在2008年时的货币流通情况完全符合费雪方程式的特点,此时甲国国内货币流通量为200元亿元,商品和服务交易价值总额为800亿元,由于受2008年金融危机的影响,甲国政府针对国内经济出现的问 ...

  10. 最热专业计算机金融专业,高考志愿填报之热门专业:金融vs计算机如何选择

    原标题:高考志愿填报之热门专业:金融vs计算机如何选择 2021年高考刚刚结束,全国人民正忙着欢度端午节小长假.再过几天,高考成绩出炉后,全国高考考生和家长就将面临志愿填报的重大抉择. 最热门专业有哪 ...

最新文章

  1. page分页php,Page分页函数
  2. 如何学好Python?相信很多人都做错了!
  3. altium designer布线调整时不自动删除旧线
  4. Zigbee通讯漫谈(初次见面)
  5. 组成新数python_大数相加 简单实现 Python 版本
  6. linux选择最短路径sdn,基于网络流量的SDN最短路径转发应用
  7. OHSUMED数据集介绍
  8. android 禁用dlsym_Android 7.0 dlopen 函数分析
  9. linux异步实现原理,Android异步处理四:AsyncTask的实现原理
  10. 协议形式化安全分析 Scyther 并非所有协议可以照抄就搬
  11. Python学习汇总,做数据采集的一些小技巧,收获满满
  12. [leetcode] Palindrome Number 回文数判断
  13. 生成并解析cron表达式
  14. linux 运行lammps,lammps linux运行
  15. 在html中做框架的页面,网页中的框架(详解)
  16. 建模实训报告总结_建模实习工作总结
  17. 计算机无法安装VC2015,VC++2015安装失败怎么办 VS2015安装失败解决方法
  18. eRPC:修改erpcgen代码生成模板增加#if#endif宏定义,解决多个eRPC服务共用时类型重复定义问题
  19. cf1009 C. Annoying Present
  20. python 监控键盘输入_python 监控键盘输入

热门文章

  1. 计算机怎么在表格里打勾,怎样在Excel输入对号√,Excel单元格怎么输入对号(方框内打勾)?...
  2. 虚拟现实的伦理问题----陈教授讲座听后感
  3. 向量数量积公式_向量数量积公式是什么
  4. 单片机测量PWM占空比的三种方法
  5. 矩阵的广义逆——减号、加号广义逆的求法
  6. 【矩阵论】矩阵基本概念 + 矩阵广义逆
  7. MSP430加密代码保护
  8. 优美诗词(持续更新)
  9. JAVA:实现求Median中位数算法(附完整源码)
  10. Android微信代扣sdk无法拉起,微信JS-SDK选择图片遇到的坑