第3章 关联分析模型

关联分析用于描述多个变量之间的关联。如果两个或多个变量之间存在一定的关联,那么其中一个变量的状态就能通过其他变量进行预测。关联分析的输入是数据集合,输出是数据集合中全部或者某些元素之间的关联关系。例如,房屋的位置和房价之间的关联关系或者气温和空调销量之间的关系。
关联分析主要包括如下分析内容:
(1)回归分析
回归分析是最灵活最常用的统计分析方法之一,它用于分析变量之间的数量变化规律,即一个因变量与一个或多个自变量之间的关系。特别适用于定量地描述和解释变量之间相互关系或者估测或预测因变量的值。例如,回归分析可以用于发现个人收入和性别、年龄、受教育程度、工作年限的关系,基于数据库中现有的个人收入、性别、年龄、受教育程度和工作年限构造回归模型,基于该模型可以根据输入的性别、年龄、受教育程度和工作年限预测个人收入。
(2)关联规则分析
关联规则分析用于发现存在于大量数据集中的关联性或相关性,从而描述了一个事物中某些属性同时出现的规律和模式。关联规则分析的一个典型例子是购物篮分析。该过程通过发现顾客放入其购物篮中的不同商品之间的联系,分析顾客的购买习惯。通过了解哪些商品频繁地被顾客同时购买,这种关联的发现可以帮助零售商制定营销策略。其他的应用还包括价目表设计、商品促销、商品的排放和基于购买模式的顾客划分。
(3)相关分析
相关分析是对总体中确实具有联系的指标进行分析。它是描述客观事物相互间关系的密切程度并用适当的统计指标表示出来的过程。例如,在经济学中,如果一段时期内出生率随经济水平上升而上升,这说明两指标间是正相关关系;而在另一时期,随着经济水平进一步发展,出现出生率下降的现象,两指标间就是负相关关系。
相关分析与回归分析在实际应用中有密切关系。然而在回归分析中,所关心的是一个随机变量Y对另一个(或一组)随机变量X的依赖关系的函数形式。而在相关分析中,所讨论的变量的地位一样,分析侧重于变量之间的种种相关特征。例如,以X、Y分别记为高中学生的数学与物理成绩,相关分析感兴趣的是二者的关系如何,而不在于由X去预测Y。

《大数据分析原理与实践》一一第3章 关联分析模型相关推荐

  1. 《大数据分析原理与实践》——第2章 大数据分析模型

    第2章 大数据分析模型 大数据分析模型讨论的问题是从大数据中发现什么.尽管对大数据的分析方法林林总总,但面对一项具体应用,大数据分析非常依赖想象力.例如,对患者进行智能导诊,为患者选择合适的医院.合适 ...

  2. 《大数据分析原理与实践》一一1.5 全书概览

    本节书摘来自华章计算机<大数据分析原理与实践>一书中的第1章,第1.5节,作者:王宏志 更多章节内容可以访问云栖社区"华章计算机"公众号查看. 1.5 全书概览 本书将 ...

  3. 《大数据分析原理与实践》一一1.2 哪里有大数据

    本节书摘来自华章计算机<大数据分析原理与实践>一书中的第1章,第1.2节,作者:王宏志 更多章节内容可以访问云栖社区"华章计算机"公众号查看. 1.2 哪里有大数据 大 ...

  4. 《大数据分析原理与实践》一一导读

    前 言 本书的缘起与成书过程 大数据经过分析能够产生高价值,这无疑已在大数据火爆的今天成为共识,从而使得大数据分析在"大数据+"涉及的领域(如工业.医疗.农业.教育等)有了广泛的应 ...

  5. 《大数据分析原理与实践》——导读

    前 言 本书的缘起与成书过程 大数据经过分析能够产生高价值,这无疑已在大数据火爆的今天成为共识,从而使得大数据分析在"大数据+"涉及的领域(如工业.医疗.农业.教育等)有了广泛的应 ...

  6. 《大数据分析原理与实践》一一2.3 推断统计

    2.3 推断统计 推断统计是研究如何利用样本数据来推断总体特征的统计方法,其目的是利用问题的基本假定及包含在观测数据中的信息,做出尽量精确和可靠的结论.基本特征是其依据的条件中包含带随机性的观测数据. ...

  7. 《大数据分析原理与实践》——小结

    小结 关联分析模型用于描述多个变量之间的关联,这是大数据分析的一种重要模型,本章主要探讨了回归分析.关联规则分析和相关分析这三类关联分析.3.1节介绍了回归分析模型,即描述一个或多个变量与其余变量的依 ...

  8. 《大数据分析原理与实践》——习题

    习题 在我们身边有哪些大数据?在这些大数据上有哪些分析任务? 比较"分析""机器学习"和"数据挖掘"的异同. 比较电子商务和工业生产中大数据 ...

  9. 智多星大数据分析云平台实践

    2014年10月,江苏银行夏平董事长确立了利用 ** 大数据 ** 实现弯道超车的发展战略,将 ** 大数据 ** 应用提升到全行发展的战略层面.2015年上半年,江苏银行完成了 大数据平台 选型和建 ...

最新文章

  1. element-ui中的loading的实际应用
  2. python中使用for循环,while循环,一条命令打印99乘法表
  3. 神经网络 | 过拟合以及 google神经网络小工具
  4. 如何去使用Python爬虫来爬取B站的弹幕数据?
  5. [译]Javascript中的闭包(closures)
  6. pcb布线拐角处打地孔_PCB线路板布线的10个重要规则——公众号【深圳LED网】
  7. Flink 零基础实战教程:如何计算实时热门商品
  8. 【Elasticsearch】Elasticsearch之元数据(meta-fields)介绍
  9. 如何在复杂的分布式系统中做测试
  10. 玩一下易语言 和字有多种读音,注定了它的重要性!!
  11. 本次安装visual studio所用的安装程序不完整_阁楼影院安装案例
  12. Java开发微信公众号后台
  13. 纯真ip数据库 linux,Python读取纯真IP数据库
  14. 青花瓷 下载App Store上历史版本的App的ipa的包
  15. html 刷新页面,javascript刷新页面的几种方法
  16. 折腾linux随笔 之 关闭Budgie默认自动隐藏应用的菜单栏 与 Gnome系桌面应用菜单无内容解决...
  17. Teemo Attacking
  18. multi-key map passed in for ordered parameter sort
  19. 咻商跨境电商获悉报告指广州深圳跨境电商运营人才需求激增
  20. 安装pandas成功但import不成功的解决办法

热门文章

  1. VC++制作DLL具体解释
  2. css3学习总结1--CSS3选择器
  3. C语言及程序设计初步例程-37 循环嵌套
  4. 国内首本免费深度学习书籍!还有人没Get么?
  5. linux之find命令,Linux基础知识之find命令详解
  6. 荧光透视的计算机辅助外科手术,「电信学」「2008.11」基于荧光透视的电磁跟踪骨科X射线导航实践研究...
  7. Spring FactoryBean的开发1
  8. 思考如何保证线程并行的数据安全性
  9. MyBatis关键配置-创建会话工厂
  10. 抽象工厂产品等级结构与产品族