阿里妹导读:文娱内容很难有完整的量化指标体系,内容的复杂性决定了文娱产品的不确定性。我们如何利用AI+大数据能力,建造文娱的内容认知大脑?串联内容全生命周期,实现对内容、流量、宣推等的“未卜先知”,提升对爆款的预测和生产能力?这本《5G+AI 阿里文娱技术实践》会告诉你。

全新电子书《5G+AI 阿里文娱技术实践》正式上线!通过窄宽高清革新、大麦物联网技术、6DoF视频技术等5大板块,带你全面了解阿里文娱独具魅力的思考。点击文末下载链接,即可下载。

一、文娱产业趋势及技术挑战

文娱内容不像商品有完整的量化指标体系,它是一个复杂的实体,它跟意识形态以及用户体验强相关,对内容进行量化评估和衡量是非常困难的。

比如,选角儿。我们不能通过单一指标去衡量一个演员,我们需要综合考量演员的演技、气质、颜值、潜力等与否与某一个角色匹配,并且能生成数据指标,以实现纵横向的对比。另外,导演、主演组盘是否为最优组合,能否成为爆款?这是更加复杂的选择模式问题。今天面临的技术挑战是如何进行知识的抽取、挖掘以及推理,确定什么样的组合是最优解。

除上述两个问题,影片的拍摄过程更是一个庞大的系统工程和艺术创作过程。以《长安十二时辰》为例,该片非群演有约1000人,群演有300到1500人,历时7个月拍摄217天。我们参考软件工程行业,软件工程发展了70年,主要研究三个层面:方法论、过程以及工具,然后是如何将三者组合。软件行业的敏捷开发对于软件工程的质量和效率都有非常大的提升,如何将这些理论应用到内容制作产业,让内容制作敏捷起来?

内容敏捷即知晓过程对结果造成的影响是什么,并快速地调整内容创作过程,让它更敏捷。但内容行业面临的独有特点“延迟满足”,让用户在内容的某一分钟特别嗨,可能来自于前面的30分钟铺垫在那一分钟爆发了,针对内容的这个特点,我们除了要做基本的知识图谱语义的理解之外,还要考虑如何去做有效的对应分析,如何去做对应的知识抽取等问题。

今天这个问题加剧了,比过去还要复杂。在过去的5到10年里,UPGC加上整个内容的生产量极大的发展,用户的消费分层化、多样化。全民爆款越来越少,用户对内容的需求更加个性化。相应于内容生产端,就需要考虑不同用户群的个性化需求。

二、文娱大脑基本框架:内容认知新动力

针对上面几大困难,我们今天在做文娱大脑——优酷北斗星智库来解决。我们将所有的内容形式和用户消费的数据都采集下来,将人工智能的技术手段、业务领域的细分理论做整合融合,构建内容认知框架。

内容认知框架分为两部分,内容和用户。其思路就是心理学发展的基本的思路。

1)内容侧:对内容进行理解,包括外延和内涵。外延就是内容的各种基本属性,比如主创阵容、题材类型等;内涵主要研究内容的戏剧理论和视听语言,围绕制作内容的支撑要素,我们用传统的机器学习方式对内容进行理解,再基于戏剧理论和视听语言构造内容的衡量要素。

2)用户侧:分析用户的观看行为。用户行为来自于用户的心理偏好、心理情绪。用户心理偏好、心理情绪来自于生理构造,基于心理学的五大人格理论和用户的观看行为,构建模型建立左边和右边的连接,从而知道创造什么样的内容,用户会有什么样的感受。

三、贯穿全生命周期的文娱大脑生产力

基于内容认知框架,我们在内容生命周期的每个阶段都做了具体工作:开播前提供内容评估、艺人挖掘和内容情绪挖掘等能力;在早期为内容评估提供有效的数据支撑;在制作阶段提供现场解决方案,比之前更敏捷的反馈机制;同样在播出后也提供数据支持,实现更好的宣发。

1、IP/剧本分析

上图是《长安十二时辰》的分析示例,我们把已有的剧本作为样本,让机器去学习,识别出剧本的所有角色,把角色直接交互的对白、行为识别出来,再进行社团的划分。《长安》剧本最终划分出来几个群体:反恐防暴小分队以张小敬为中心,唐朝核心管理团队以皇上为中心。通过这种方式快速定位整个剧本的人物和人物关系的展开。

2、用户情绪识别与成片情绪挖掘

围绕角色关系,将整个剧本的角色情绪也识别出来,构造成如上的曲线。基于对海量剧本的分析曲线,抽取出各个指标(出镜率、戏份、情绪值等)并形成benchmark,对于之后的每一个剧本进行衡量,相当于对剧本进行一个“体检”。

同样是“体检”的方法,对于《药神》和《长安十二时辰》,我们做了用户情绪的识别、体检的扫描,参考零线的位置。我们发现《药神》几乎都是正向和负向级的,直到最后出现一个正向区间,基本上后期都是以眼泪为主。而《长安十二时辰》的情绪状态比较稳定。对照情绪高低点的具体情节,我们发现,曲线表达的情绪和具体的故事情节是非常相符的。

3、情绪强度预测与网络收视率

然后我们拿更多的方式去验证它的合理性,上图抽取《长安十二时辰》的剧集,每集有两条曲线,蓝线是刚才预测的情绪曲线,黄线是播放指数(表示每一秒钟有多少用户在看),通过两条曲线对比,我们可以发现,两条曲线的相关性比较高的将近60%,情绪的高峰、低谷和用户的观看行为状态是吻合的,由此我们就提供了一种能力,基于这种能力对剧本或影片做情绪扫描,实现对影片热度的未播先知,再对比benchmark,帮助制作者更高效的完成制作。

4、用户情感曲线在技术上是如何实现的?

首先,我们把用户观影情绪的表述,映射到认知计算中常用的二维空间表示,也就是Valence 和Arousal。Valence表示情绪正负极性,Arousal表示情感激烈程度;

其次,基于情绪极性跟强度提供一个预测,这个是我们今年产出的论文。近两年,心理学研究的核心观点是为什么用户会感同身受?这来自于前两年的一个理论——静向神经元,所以我们选择场景、表情、动作以及声音作为基本的模型的输入,对模型参数进行学习。

如上所讲,内容产业有强延迟满足的问题,我们通过两层分析来解决长短期满足的问题,除用户情绪分析,我们也做内容角色的情绪识别。通过图片表情识别模型,识别不同题材类型的影片,可以获得不同角色刻画的人物性格。如2004年的《反贪风暴》,时隔十多年,主创人物形象的脸谱还是正向的。上图显示的负面角色情绪以开心、害怕为主,正面形象以悲伤、生气为主,与负面反派的开心正好相对,正面的人一直很沮丧,是一个有些压抑角色形象。

同样,我们分析角色的每秒情绪,形成角色的正负情绪曲线,部分影片的分析结果曲线如上图,不同题材类型的节目会有不同的情绪密度。所以,你想放松的时候,要看的不一定是喜剧,喜剧其实不一定会放松,因为角色的正负向情绪不停交替,由于延迟满足,大脑负荷非常大,需要做长短记忆,反而很多爱情片对大脑的占用相对低。

角色情绪检测是一个分类问题,所以利用人脸landmark对初始图像做识别,生成densemap作为附加通道,和原始图片RGB三通道拼接合并后作为模型输入,这样可以使densemap对应的关键区域权重更大,更容易让模型捕捉关键区域特征;合成的输入送入到Reduced Xception 网络进行特征提取;在loss方面,我们引入了基于SVM的marge loss,提升各情绪类别的类间差距,提升情绪识别的效果,具体如上图。

基于前面对内容的各种理解产生的各种纬度的内容的量化纬度,我们构建了预测模型,可以提前预测出节目的流量走势,如内容认知框架中所讲的,首先对内容进行量化,然后对内容相应的量化纬度进行提前的预测,为业务决策提供辅助支撑。

最后,分享我对未来趋势的一些见解。在强人工智能尚遥远的情形下,如何结合机器AI和人工经验将是个永恒主题。一是结合符号学派智能和链接学派智能,建设和完善决策引擎,包括结合人工逻辑规则和可学习数据AI,不确定性分析框架和经久不衰的贝叶斯因果决策,以及神经元化的混合智能计算框架。二是量化的心理学研究也越来越重要,如何结合大数据应用价值非常大。这也是阿里文娱大脑探索的方向。

从优酷窄宽高清革新布局
到大麦物联网的实践之路
从文娱内容认知的AI大脑
到交互式的6DoF视频技术
5G时代来临
如何用新技术提升用户体验?
《5G+AI 阿里文娱技术实践》正式上线!
点击立刻下载

原文链接
本文为云栖社区原创内容,未经允许不得转载。

阿里文娱首次公开!AI 如何对爆款内容未卜先知?相关推荐

  1. 打造爆款内容的7字真言

    打造爆款内容的7字真言 凡事有套路. 万维钢在他的<万万没想到>里说过这样一句话:对脑力工作者来说,水平高低在于掌握的套路有多少. 对于一个自媒体人.营销人来说,永远要记得去研究.分析.总 ...

  2. 视频号如何打造爆款内容,封面、选题、文案三大维度丨国仁网络

    随着短视频的火热,短视频内容的好坏更是能直接带动账号未来的变现,而一个短视频账号运营得好不好,有一个很重要的判断标准就是账号是否产生过爆款视频. 因为爆款短视频的产生既是账号拥有产出优质内容的能力的体 ...

  3. 自媒体辅助工具,辅助你打造爆款内容

    自媒体辅助工具,辅助你打造爆款内容,现在的自媒体辅助工具有很多,自媒体辅助工具中像易撰爆文采集器,蚁小二一键分发工具等等,都是属于自媒体辅助工具,这些工具如果使用的好,那么提高你的内容发布速度是很容易 ...

  4. 我赢助手小技巧:学会这三招,爆款内容视频完播率提高50%(下)

    上一篇我们说了爆款内容的四大共性和底层逻辑,今天我们来看一看如何去设置标题.封面和剧情,实现视频的完播率. 第三个技巧叫内容高潮. 要在3秒钟之内让用户兴趣高涨,把这样的脚本写出来,怎么样去做?你要把 ...

  5. 我赢助手小技巧:学会这三招,爆款内容视频完播率提高50%(上)

    上一篇我们说了爆款内容的四大共性和底层逻辑,今天我们来看一看如何去设置标题.封面和剧情,实现视频的完播率. 平台的官方数据给出来观看超过前3秒的用户,那么有56%的都看完了整个视频,所以抓住视频黄金3 ...

  6. 我赢助手小技巧:学会这三招,爆款内容视频完播率提高50%(中)

    上一篇我们说了爆款内容的四大共性和底层逻辑,今天我们来看一看如何去设置标题.封面和剧情,实现视频的完播率. 第二个技巧是标题,标题里面我们强调的套路. 你同样的要把关键词突出,你在封面上有文案的标题, ...

  7. 《长安十二时辰》背后的文娱大脑:如何提升爆款的确定性?

    本文整理自LiveVideoStack线上分享第三季,第九期,由阿里巴巴资深算法专家,蔡龙军(牧己)为大家详细介绍如何在制作和播出阶段,利用AI和大数据来提升重要环节的确定性,进而提升内容爆款的可能性 ...

  8. AI绘画与虚拟人生成实践(二):智能不智障!用chatgpt自动写爆款内容

    书接上回,本篇的目的是结合上篇生成的虚拟的女生形象,给它配上一段关于介绍AI绘画领域的脚本,下一篇会让生成的虚拟形象来念这段文案.先进入正题说明怎么使用chatgpt来生成想要的文案. 本文中使用的是 ...

  9. 快手抖音等平台账号运营从0到1:爆款内容

    抖音.快手等短视频平台喜欢什么样内容的作品,哪类内容很容易成为爆款作品.小编分析了上千余条不同平台热门短视频后,总结出以下七类: 一见倾心 最核心的一个点红心原因就是外表吸引力.用一个梗来阐述就是:& ...

最新文章

  1. Redis初学17:集群
  2. SQL Server 2008创建数据库
  3. 文本分类与聚类(text categorization and clustering)
  4. 新手坐高铁怎么找车厢_京沪高铁设置静音车厢,你怎么看?
  5. 天津理工大学c语言上机报告3,天津理工大学-c语言上机报告4.pdf
  6. 探索cqrs和事件源_编写基于事件的CQRS读取模型
  7. Codeforces Round #496 (Div. 3 ) E1. Median on Segments (Permutations Edition)(中位数计数)
  8. 前端与移动开发之vue-day1(1)
  9. 内含20万“不可描述”图片,这个数据集千万别在办公室打开
  10. java中怎么把两个JTextfield中的数字相加的值放到另一个JTextfield?_如何将jtextfield中的值解析为整数并对其执行一些数学操作?...
  11. SQL Server Join方式
  12. Python 正则式学习笔记 [转]
  13. FreeRTOS 教程指南 学习笔记 第四章 队列管理
  14. bios升级 acer linux,《原创》Acer更新BIOS的问题,傻瓜都会
  15. 课程设计---宾馆客房管理系统
  16. java 生辰八字五行计算,五行八字(生辰八字五行计算器)
  17. 科研必备 | 谷歌学术高级搜索详解
  18. centos如何安装软件
  19. 合格前端系列第七弹-移动端开发踩过的一些坑
  20. 配置高档游戏型计算机,2021年游戏台式电脑配置推荐

热门文章

  1. 华为手机如何固定横屏_华为手机如何录屏?原来方法这么简单,手把手教你学会...
  2. python编写抢座位软件_程序员硬核Python抢票教程”,帮你抢回家车票
  3. php 安装 bzip2,php如何安装bzip2
  4. java开发,年薪15W的和年薪50W的差距
  5. flutter字体不跟随系统_Flutter自定义字体无法加载
  6. 计算机大作业论文意义,大学的大作业是什么?
  7. 99岁杨振宁寄语青年学子:要清楚方向、选对方向
  8. 6年20多篇重磅论文,27岁浙大女博导太飒了~
  9. 科研牛人是如何看文献的?
  10. 如何计算一只鸡的表面积?