【统计学】三大相关系数之皮尔逊相关系数(person correlation coefficient)
统计学中的三大相关性系数:pearson, spearman, kendall,他们反应的都是两个变量之间变化趋势的方向以及程度,其值范围为-1到+1。
0表示两个变量不相关,正值表示正相关,负值表示负相关,值越大表示相关性越强。
- person correlation coefficient(皮尔森相关性系数)
皮尔逊相关系数通常用r或ρ表示,度量两变量X和Y之间相互关系(线性相关)
(1)公式
皮尔森相关性系数的值等于它们之间的协方差cov(X,Y)除以它们各自标准差的乘积(σX, σY)。
(2)数据要求
a.正态分布
它是协方差与标准差的比值,并且在求皮尔森相关性系数以后,通常还会用t检验之类的方法来进行皮尔森相关性系数检验,而t检验是基于数据呈正态分布的假设的。
b.实验数据之间的差距不能太大
比如:研究人跑步的速度与心脏跳动的相关性,如果人突发心脏病,心跳为0(或者过快与过慢),那这时候我们会测到一个偏离正常值的心跳,如果我们把这个值也放进去进行相关性分析,它的存在会大大干扰计算的结果的。
计算积距pearson相关系数,连续性变量才可采用;
计算Spearman秩相关系数,适合于定序变量或不满足正态分布假设的等间隔数据;
计算Kendall秩相关系数,适合于定序变量或不满足正态分布假设的等间隔数据。
import pandas as pd
import numpy as np#原始数据
X1=pd.Series([1, 2, 3, 4, 5, 6])
Y1=pd.Series([0.3, 0.9, 2.7, 2, 3.5, 5])X1.mean() #平均值# 3.5
Y1.mean() #2.4
X1.var() #方差#3.5
Y1.var() #2.9760000000000004X1.std() #标准差不能为0# 1.8708286933869707
Y1.std() #标准差不能为0#1.725108692227826
X1.cov(Y1) #协方差#3.0600000000000005X1.corr(Y1,method="pearson") #皮尔森相关性系数 #0.948136664010285
X1.cov(Y1)/(X1.std()*Y1.std()) #皮尔森相关性系数 # 0.948136664010285
写于2020年4月15日
base:北京
-----------------------------分享结束线------------------------------
喜欢可以关注【小猪课堂】公众号了解更多编程小技巧
【统计学】三大相关系数之皮尔逊相关系数(person correlation coefficient)相关推荐
- ML之PPMCC:PPMCC皮尔逊相关系数(Pearson correlation coefficient)、Spearman相关系数的简介、案例应用之详细攻略
ML之PPMCC:PPMCC皮尔逊相关系数(Pearson correlation coefficient).Spearman相关系数的简介.案例应用之详细攻略 目录 PPMCC皮尔逊相关系数的简介 ...
- ML之FE:PCC皮尔逊相关系数(Pearson correlation coefficient)的简介、案例应用(与spearman相关系数对比及其代码实现)之详细攻略
ML之FE:PCC皮尔逊相关系数(Pearson correlation coefficient)的简介.案例应用(与spearman相关系数对比及其代码实现)之详细攻略 目录 PCC/PPMCC皮尔 ...
- 皮尔逊相关系数 Pearson correlation coefficient
在统计学中,皮尔逊相关系数( Pearson correlation coefficient),又称皮尔逊积矩相关系数(Pearson product-moment correlation coeff ...
- 皮尔森(Pearson correlation coefficient)相关系数—统计学三大相关系数之一
概述 皮尔森相关系数也称皮尔森积矩相关系数(Pearson product-moment correlation coefficient) ,是一种线性相关系数,是最常用的一种相关系数.记为r,用来反 ...
- 统计学三大相关系数---Pearson、Spearman、kendall / RMSE与实现(附代码)
算法实现:这里直接调库 from scipy import stats import numpy as np val_PLCC = stats.pearsonr(y_pred, y_val)[0] v ...
- 统计学三大相关系数之肯德尔(kendall)相关性系数
肯德尔相关性系数,又称肯德尔秩相关系数,它也是一种秩相关系数,不过它所计算的对象是分类变量. 分类变量可以理解成有类别的变量,可以分为 无序的,比如性别(男.女).血型(A.B.O.AB): 有序的, ...
- 统计学三大相关系数——Kendall τ(tau)
参考链接:http://blog.sina.com.cn/s/blog_69e75efd0102wmd2.html
- 计算斯皮尔曼的等级相关系数(Spearman’s rank correlation coefficient)步骤
代码连接:code ( Matlab ) Spearman相关系数是在Pearson相关系数的基础上,利用两个集合中元素在各自集合的等级(排名)来计算他们之间的相关性,可以用于对数据进行分析. 假设两 ...
- python怎么计算相关系数_Python三种方法计算皮尔逊相关系数
1.皮尔逊相关系数在统计学中,皮尔逊相关系数( Pearson correlation coefficient),又称皮尔逊积矩相关系数(Pearson product-moment correlat ...
最新文章
- RGB Color Codes Chart
- JEECMS V3.0 常用标签使用说明
- Gradle project refresh failed
- 【产品】腾讯内部的顶级产品课:灵动在细节
- (转)LCA模板(倍增法)
- Python错误,pip安装包或更新时因超时而报错误
- 简单的窗体抖动托管c++
- 经常使用的文件工具类
- ubuntu shell 直接输入密码
- SpringBoot使用菜鸟物流云打印电子面单
- openwrt折腾记2-广告拦截adbyby与pass
- CryEngine 渲染流程
- 斐波纳契数列 python123
- cPanel/WHM前台后台的常用操作
- PhpStorm修改字体和主题
- IPv6下的DHCPv6
- Autofill Framework(自动填写)用法详解
- JVM--Java堆外内存--使用/作用
- python读取串口数据 绘图_使用Python串口实时显示数据并绘图的例子
- b mino为什么退出block_虚势爱豆!地下rapper!进YG不足半年就出道!WINNER的宋闵浩Mino...