转自http://blog.sciencenet.cn/home.php?mod=space&uid=255662&do=blog&id=240107

正态总体均值的假设检验

t检验

单个总体

例一

某种元件的寿命X(小时),服从正态分布,N(mu,sigma^2),其中mu,sigma^2均未知,16只元件的寿命如下:问是否有理由认为元件的平均寿命大于255小时。

命令:

X

222, 362, 168, 250, 149, 260, 485, 170)

t.test(X, alternative = "greater", mu = 225)

两个总体

例二

X为旧炼钢炉出炉率,Y为新炼钢炉出炉率,问新的操作能否提高出炉率

命令:

X

Y

t.test(X, Y, var.equal=TRUE, alternative = "less")

成对数据t检验

例三

对每个高炉进行配对t检验

命令:

X

Y

t.test(X-Y, alternative = "less")

正态总体方差的假设检验

例四

从小学5年级男生中抽取20名,测量其身高(厘米)如下:

问,在0.05显著性水平下,

平均值是否等于149

sigma^2 是否等于 75

命令:

X

136 144 143 157 137 159 135 158 147 165

158 142 159 150 156 152 140 149 148 155

var.test(X,Y)

例五

对炼钢炉的数据进行分析

命令:

X

Y

var.test(X,Y)

二项分布的总体检验

例六

有一批蔬菜种子的平均发芽率为P=0.85,现在随机抽取500粒,用种衣剂进行浸种处理,结果有445粒发芽,问种衣剂有无效果。

命令:

binom.test(445,500,p=0.85)

例七

按照以往经验,新生儿染色体异常率一般为1%,某医院观察了当地400名新生儿,有一例染色体异常,问该地区新生儿染色体是否低于一般水平?

命令:

binom.test(1,400,p=0.01,alternative="less")

非参数检验

#数据是否正态分布的Neyman-Pearson 拟合优度检验-chisq

例八

5种品牌啤酒爱好者的人数如下

A 210

B 312

C 170

D 85

E 223

问不同品牌啤酒爱好者人数之间有没有差异?

命令:

X

chisq.test(X)

例九

检验学生成绩是否符合正态分布

命令:

X

25 45 50 54 55 61 64 68 72 75 75

78 79 81 83 84 84 84 85 86 86 86

87 89 89 89 90 91 91 92 100

A

p

p

chisq.test(A,p=p)

# cut 将变量区域划分为若干区间

# table 计算因子合并后的个数

# 均值之间有无显著区别

大麦的杂交后代芒性状的比例 无芒:长芒: 短芒=9:3:4,而实际观测值为335:125:160

,检验观测值是否符合理论假设?

命令:

chisq.test(c(335, 125, 160), p=c(9,3,4)/16)

例十

#

现有42个数据,分别表示某一时间段内电话总机借到呼叫的次数,

# 接到呼叫的次数 0  1  2

3  4  5

6

# 出现的频率  7  10  12  8  3

2  0

# 问:某个时间段内接到的呼叫次数是否符合Possion分布?

命令:

x

y

mean

q

n

p[1]

p[n]

for(i in 2:(n-1))

p

chisq.test(y, p=p)

Z

n

chisq.test(Z, p=p)

内容来自

薛毅 陈立萍 《统计建模与R软件》 清华大学出版社 2006

-----------------------------------

转自http://blog.sciencenet.cn/home.php?mod=space&uid=255662&do=blog&id=240107

# 理论分布依赖于若干未知参数时

# Kolmogorov-Smirnov 检验

# ks.test() 例一

对一台设备进行寿命检验,记录十次无故障操作时间,并按从小到大的次序排列如下,

# 用ks检验方法检验此设备无故障工作时间是否符合rambda=1/1500的指数分布

# 命令:

X

2350)

ks.test(X, "pexp", 1/1500)

例二

假设从分布函数F(x)和G(x)的总体中分别随机抽取25个和20个观察值样本,检验F(x)和G(x)是否相同。

# 命令

X

0.61 0.29 0.06 0.59 -1.73 -0.74 0.51 -0.56 0.39

1.64 0.05 -0.06 0.64 -0.82 0.37 1.77 1.09 -1.28

2.36 1.31 1.05 -0.32 -0.40 1.06 -2.47

Y

2.20 1.66 1.38 0.20 0.36 0.00 0.96 1.56 0.44

1.50 -0.30 0.66 2.31 3.29 -0.27 -0.37 0.38 0.70

0.52 -0.71

ks.test(X, Y)

# ks多样本检验的局限性,只用在理论分布为一维连续分布,且分布完全已知的情形。ks检验可用的情况下,功效一般优于Pearson

chisq检验

# 列联表(contingerncy table)的独立性检验

# Pearson chisquare 进行独立性检验

例三

为了研究吸烟是否与肺癌有关,对63位患者及43名非肺癌患者调查了其中的吸烟人数,得到2*2列联表

# 数据  肺癌  健康  合计

# 吸烟  60  32

92

# 不吸烟  3  11

14

# 合计  63  43

106

# 命令

x

dim(x)

chisq.test(x,correct = FALSE) # 不带连续校正的情况

chisq.test(x) # 带连续校正的情况

例四

在一次社会调查中,以问卷方式调查了901人的年收入,及其对工作的满意程度,其中年收入A分为四档:小于6000元,6000-15000元,15000元至25000元,超过25000元。对工作的满意程度B

分为 很不满意,较不满意,基本满意和很满意四档,结果如下

#  很不满意  较不满意  基本满意  很满意  合计

# < 6000  20  24

80  82

206

# 6000 ~15000  22

38  104  125

289

# 15000~25000  13

28  81  113  235

# > 25000  7  18  54  92  171

# 合计  62  108

319

412  901

# 命令如下

x

20 24 80 82 22 38 104 125

13 28 81 113 7 18 54 92

dim(x)

chisq.test(x)

# Fisher 精确的独立检验

# 试用条件 样本数小于4

例五

某医师研究乙肝免疫球蛋白防止子宫内胎儿感染HBV的效果,将33例HBsAg阳性孕妇随机分为预防注射组和对照组,结果由下表所示,两组新生儿HBV总体感染率有无差别

# 组别  阳性  阴性  合计

感染率

# 预防注射组  4  18  22  18.8

# 对照组  5  6  11  45.5

# 命令如下

x

fisher.test(x)

# 对前面提到的肺癌进行检验

x

dim(x)

fisher.test(x)

# McNemar检验

# McNemar检验不是独立性检验,但是是关于列连表的检验

例六

甲乙两种方法检测细菌的结果

#  乙方法  #  合计

# 甲方法  +  -

r语言平均值显著性检验_R语言:常用统计检验方法相关推荐

  1. r语言平均值显著性检验_R语言入门:检验相关性的显著性

    一.问题 计算两个变量的相关性,但不知道相关性在统计上是否足够显著. 二.解决方案 cor.test函数不仅可以计算P值,还可以算出相关性的可信区间.如果变量来自正态分布总体,可以用默认的相关性定义, ...

  2. r语言平均值显著性检验_最全的R语言统计检验方法_数据挖掘中R语言的运用

    最全的R语言统计检验方法_数据挖掘中R语言的运用 统计检验是将抽样结果和抽样分布相对照而作出判断的工作.主要分5个步骤:建立假设 求抽样分布 选择显著性水平和否定域 计算检验统计量 判定 假设检验(h ...

  3. r语言清除变量_R语言(1)初识与数据结构

    点击上方蓝字,记得关注我们! a picture is worth a thousand words! 一,R语言简介 1,R语言的发展 上世纪90年代初,新西兰奥克兰大学 Ross Ihaka 和 ...

  4. r语言 tunerf函数_R语言 | 一网打尽高质量统计分析与机器学习包

    原标题:R语言 | 一网打尽高质量统计分析与机器学习包 146+72本期刊<SCI期刊分析+选刊网站>免费领 解螺旋公众号·陪伴你科研的第2232天 常用统计方法包+机器学习包(名称.简介 ...

  5. r - 求平均成绩_R语言 从零开始的笔记(一)

    R是用于统计分析.绘图的语言和操作环境.R是属于GNU系统的一个自由.免费.源代码开放的软件,它是一个用于统计计算和统计制图的优秀工具. R语言于生物学分析中的应用越来越广泛,在其他领域的统计绘图应用 ...

  6. R 多变量数据预处理_R语言常用统计方法包+机器学习包(名称、简介)

    上期帮大家盘点了一下R中常用的可视化包,这期将简要盘点一下关于统计分析与机器学习的R包,并通过简要介绍包的特点来帮助读者深入理解可视化包. 本文作者为"食物链顶端"学习群中的小伙伴 ...

  7. r语言 tunerf函数_R语言︱常用统计方法包 机器学习包(名称、简介)

    一.一些函数包大汇总 转载于:http://www.dataguru.cn/thread-116761-1-1.html 时间上有点过期,下面的资料供大家参考 基本的R包已经实现了传统多元统计的很多功 ...

  8. R语言迹检验协整关系式_R语言中可实现的常用统计假设检验总结(侧重时间序列)...

    > # Null hypothesis: > # There are n cointegrated vectors. 有n个协整向量 > install.packages('urca ...

  9. r语言平均值显著性检验_8小时整理!t检验原理!R语言实现!一文彻底搞定t检验(上)...

    本文中会加一些注解,是对于一些常用混淆概念得解释.主要内容包括t检验适用范围.实际案例以及R语言的实现. 因文章内容过长,所以分为上下两篇 t检验(t test)亦称 t检验,以t分布为基础,是定量资 ...

最新文章

  1. CentOS安装配置之基本
  2. 还有 13 天,苹果就要关上 HTTP 大门了
  3. mysql命令集合,MySql常用命令集合
  4. 【干货】产品需求确定后,不要着急设计原型
  5. 由苹果审核悲剧引发的“血案”
  6. redis和memcached缓存
  7. 关于Tomcat5.5中EL表达式无效的解决办法
  8. 如何确定h.264的码率
  9. 以张鸿蒙系统的手机,搭载鸿蒙系统的手机真的要来了?因为别无选择,所以唯有向前!...
  10. RDS还原数据库时报错:ERROR 1227 (42000) at line 78664
  11. ArcGIS 生成要素轮廓线掩膜
  12. 为什么败者树的访问外存次数要比胜者树少_为什么说蒙地卡罗搜索树MCTS是AlphaZero的核心?[AlphaZero理论篇之三]...
  13. 史上最管用的C盘深度清理秘籍
  14. 女神:今天我3倍工资,放假半天 有法可依,我...
  15. 服务器性能差用cdn有用吗,CDN加速有用吗?对网站有什么好处?
  16. win10下,更改程序磁贴图标
  17. 合成大西瓜之抱歉~ 我只有大西瓜和刀剑神域~!!
  18. 笨方法学Python3复习
  19. 中国剩余定理 (孙子定理) 的证明和代码
  20. We Can't Subsidize The Banks Forever

热门文章

  1. 全国科技者工作日:关注科技工作者的工作与贡献,共创美好未来
  2. Uncaught ReferenceError: xxx is not defined at HTMLButtonElement.onclick
  3. 李斌公开回应“奶妈车”:油能运,怎么就不让运电?
  4. 养龟小记-宠物的命运
  5. 偏执狂才能生存,flickr的若干举措如是说
  6. 深入DIY,打造超苗条绿色REAL播放器
  7. 大数据等最核心的关键技术:32个算法
  8. BotFramework-WebChat 实现点击标签发送消息
  9. 20200220–靶场记录,web渗透+内网渗透完整版
  10. android 老人手机排行榜,给父母的礼物!一键让Android变身老人机