统计学中的三大相关性系数:pearson, spearman, kendall,他们反应的都是两个变量之间变化趋势的方向以及程度,其值范围为-1到+1。
0表示两个变量不相关,正值表示正相关,负值表示负相关,值越大表示相关性越强。

  1. person correlation coefficient(皮尔森相关性系数)
    皮尔逊相关系数通常用r或ρ表示,度量两变量X和Y之间相互关系(线性相关)
    (1)公式
    皮尔森相关性系数的值等于它们之间的协方差cov(X,Y)除以它们各自标准差的乘积(σX, σY)。
    (2)数据要求
    a.正态分布
    它是协方差与标准差的比值,并且在求皮尔森相关性系数以后,通常还会用t检验之类的方法来进行皮尔森相关性系数检验,而t检验是基于数据呈正态分布的假设的。
    b.实验数据之间的差距不能太大
    比如:研究人跑步的速度与心脏跳动的相关性,如果人突发心脏病,心跳为0(或者过快与过慢),那这时候我们会测到一个偏离正常值的心跳,如果我们把这个值也放进去进行相关性分析,它的存在会大大干扰计算的结果的。

    计算积距pearson相关系数,连续性变量才可采用;
    计算Spearman秩相关系数,适合于定序变量或不满足正态分布假设的等间隔数据;
    计算Kendall秩相关系数,适合于定序变量或不满足正态分布假设的等间隔数据。
import pandas as pd
import numpy as np#原始数据
X1=pd.Series([1, 2, 3, 4, 5, 6])
Y1=pd.Series([0.3, 0.9, 2.7, 2, 3.5, 5])X1.mean() #平均值# 3.5
Y1.mean() #2.4
X1.var() #方差#3.5
Y1.var() #2.9760000000000004X1.std() #标准差不能为0# 1.8708286933869707
Y1.std() #标准差不能为0#1.725108692227826
X1.cov(Y1) #协方差#3.0600000000000005X1.corr(Y1,method="pearson") #皮尔森相关性系数 #0.948136664010285
X1.cov(Y1)/(X1.std()*Y1.std()) #皮尔森相关性系数 # 0.948136664010285

写于2020年4月15日
base:北京
-----------------------------分享结束线------------------------------

喜欢可以关注【小猪课堂】公众号了解更多编程小技巧

【统计学】三大相关系数之皮尔逊相关系数(person correlation coefficient)相关推荐

  1. ML之PPMCC:PPMCC皮尔逊相关系数(Pearson correlation coefficient)、Spearman相关系数的简介、案例应用之详细攻略

    ML之PPMCC:PPMCC皮尔逊相关系数(Pearson correlation coefficient).Spearman相关系数的简介.案例应用之详细攻略 目录 PPMCC皮尔逊相关系数的简介 ...

  2. ML之FE:PCC皮尔逊相关系数(Pearson correlation coefficient)的简介、案例应用(与spearman相关系数对比及其代码实现)之详细攻略

    ML之FE:PCC皮尔逊相关系数(Pearson correlation coefficient)的简介.案例应用(与spearman相关系数对比及其代码实现)之详细攻略 目录 PCC/PPMCC皮尔 ...

  3. 皮尔逊相关系数 Pearson correlation coefficient

    在统计学中,皮尔逊相关系数( Pearson correlation coefficient),又称皮尔逊积矩相关系数(Pearson product-moment correlation coeff ...

  4. 皮尔森(Pearson correlation coefficient)相关系数—统计学三大相关系数之一

    概述 皮尔森相关系数也称皮尔森积矩相关系数(Pearson product-moment correlation coefficient) ,是一种线性相关系数,是最常用的一种相关系数.记为r,用来反 ...

  5. 统计学三大相关系数---Pearson、Spearman、kendall / RMSE与实现(附代码)

    算法实现:这里直接调库 from scipy import stats import numpy as np val_PLCC = stats.pearsonr(y_pred, y_val)[0] v ...

  6. 统计学三大相关系数之肯德尔(kendall)相关性系数

    肯德尔相关性系数,又称肯德尔秩相关系数,它也是一种秩相关系数,不过它所计算的对象是分类变量. 分类变量可以理解成有类别的变量,可以分为 无序的,比如性别(男.女).血型(A.B.O.AB): 有序的, ...

  7. 统计学三大相关系数——Kendall τ(tau)

    参考链接:http://blog.sina.com.cn/s/blog_69e75efd0102wmd2.html

  8. 计算斯皮尔曼的等级相关系数(Spearman’s rank correlation coefficient)步骤

    代码连接:code ( Matlab ) Spearman相关系数是在Pearson相关系数的基础上,利用两个集合中元素在各自集合的等级(排名)来计算他们之间的相关性,可以用于对数据进行分析. 假设两 ...

  9. python怎么计算相关系数_Python三种方法计算皮尔逊相关系数

    1.皮尔逊相关系数在统计学中,皮尔逊相关系数( Pearson correlation coefficient),又称皮尔逊积矩相关系数(Pearson product-moment correlat ...

最新文章

  1. RGB Color Codes Chart
  2. JEECMS V3.0 常用标签使用说明
  3. Gradle project refresh failed
  4. 【产品】腾讯内部的顶级产品课:灵动在细节
  5. (转)LCA模板(倍增法)
  6. Python错误,pip安装包或更新时因超时而报错误
  7. 简单的窗体抖动托管c++
  8. 经常使用的文件工具类
  9. ubuntu shell 直接输入密码
  10. SpringBoot使用菜鸟物流云打印电子面单
  11. openwrt折腾记2-广告拦截adbyby与pass
  12. CryEngine 渲染流程
  13. 斐波纳契数列 python123
  14. cPanel/WHM前台后台的常用操作
  15. PhpStorm修改字体和主题
  16. IPv6下的DHCPv6
  17. Autofill Framework(自动填写)用法详解
  18. JVM--Java堆外内存--使用/作用
  19. python读取串口数据 绘图_使用Python串口实时显示数据并绘图的例子
  20. b mino为什么退出block_虚势爱豆!地下rapper!进YG不足半年就出道!WINNER的宋闵浩Mino...

热门文章

  1. 关于在Cocos-creator中使用微信小程序的api
  2. docker-compose、kubernetes安装部署fastdfs文件集群系统
  3. TensorFlow可微编程实践2---自动微分符号体系
  4. Python Pdb源码解析
  5. 基于labview的tcp通信设计简要教程
  6. 高中数学必修二平面解析几何之两直线的位置关系(归纳与整理)
  7. kotlin 实战之面向对象特性全方位总结
  8. 安装vmware虚拟机详细教程
  9. 聊一聊Rust的结构体
  10. 博士学位真的那么重要吗?上交大博士亲述科研心路,获4万高赞!