P值,“差异具有显著性”和“具有显著差异”

P值是论文中最常用的一个统计学指标,可是其误用、解释错误的现象却很常见。因此,很有必要说明p值的意义、用法及常见错误。

P值指的是比较的两者的差别是由机遇所致的可能性大小。P值越小,越有理由认为对比事物间存在差异。例如,P<0.05,就是说结果显示的差别是由机遇所致的可能性不足5%,或者说,别人在同样的条件下重复同样的研究,得出相反结论的可能性不足5%。P>0.05称“不显著”;P<=0.05称“显著”,P<=0.01称“非常显著”。

由于常用“显著”来表示P值大小,所以P值最常见的误用是把统计学上的显著与临床或实际中的显著差异相混淆,即混淆“差异具有显著性”和“具有显著差异”二者的意思。其实,前者指的是p<=0.05,即说明有充分的理由认为比较的二者来自同一总体的可能性不足5%,因而认为二者确实有差异,下这个结论出错的可能性<=5%。而后者的意思是二者的差别确实很大。举例来说,4和40的差别很大,因而可以说是“有显著差异”,而4和4.2差别不大,但如果计算得到的P值<=0.05,则认为二者“差别有显著性”,但是不能说“有显著差异”。

由于“有显著差异”和“差异具有显著性”容易混淆,因而现在有些期刊提倡用“差异有统计意义”来代替“差异有显著性”,用“差异无统计意义”、“差异有高度统计意义”来代替“差异不显著”和“差异有高度显著性”。例如《中华胃肠外科学》即是如此。

如果P>5%,是否我们就可以下结论说比较的二者没有差别呢?不能。P>5%只能说明没有充分的证据说明二者确有差别,但是也不能说二者没有差别或差别很小。在这两个极端之间还有一个过渡区间,即无论下有差别还是没有差别或差别很小的证据都不足。要推断二者没有差别或差别很小,需要采用等效检验的统计推断方法。

不得不提的P值

的确,P值是最常用的一个统计学指标,几乎统计软件输出结果都有P值。了解p值的由来、计算和意义很有必要。

一、P值的由来

R·A·Fisher(1890-1962)作为一代假设检验理论的创立者,在假设检验中首先提出P值的概念。他认为假设检验是一种程序,研究人员依照这一程序可以对某一总体参数形成一种判断。也就是说,他认为假设检验是数据分析的一种形式,是人们在研究中加入的主观信息。(当时这一观点遭到了Neyman-Pearson的反对,他们认为假设检验是一种方法,决策者在不确定的条件下进行运作,利用这一方法可以在两种可能中作出明确的选择,而同时又要控制错误发生的概率。这两种方法进行长期且痛苦的论战。虽然Fisher的这一观点同样也遭到了现代统计学家的反对,但是他对现代假设检验的发展作出了巨大的贡献。)Fisher的具体做法是:

  1. 假定某一参数的取值。
  2. 选择一个检验统计量(例如z 统计量或Z 统计量) ,该统计量的分布在假定的参数取值为真时应该是完全已知的。
  3. 从研究总体中抽取一个随机样本4计算检验统计量的值5计算概率P值或者说观测的显著水平,即在假设为真时的前提下,检验统计量大于或等于实际观测值的概率。
  • 如果P<0.01,说明是较强的判定结果,拒绝假定的参数取值。
  • 如果0.01<P值<0.05,说明较弱的判定结果,拒接假定的参数取值。
  • 如果P值>0.05,说明结果更倾向于接受假定的参数取值。

可是,那个年代,由于硬件的问题,计算P值并非易事,人们就采用了统计量检验方法,也就是我们最初学的t值和t临界值比较的方法。统计检验法是在检验之前确定显著性水平αα,也就是说事先确定了拒绝域。但是,如果选中相同的αα,所有检验结论的可靠性都一样,无法给出观测数据与原假设之间之间不一致程度的精确度量。只要统计量落在拒绝域,假设的结果都是一样,即结果显著。但实际上,统计量落在拒绝域不同的地方,实际上的显著性有较大的差异。

因此,随着计算机的发展,P值的计算不再是个难题,使得P值变成最常用的统计指标之一。

为理解P值的计算过程,用ZZ表示检验的统计量,ZCZC表示根据样本数据计算得到的检验统计量值。

左侧检验 H0:μ≥μ0H0:μ≥μ0 vs H1:μ<μ0H1:μ<μ0

P值是当μ=μ0μ=μ0时,检验统计量小于或等于根据实际观测样本数据计算得到的检验统计量值的概率,即p值 = P(ZC≤Z|μ=μ0)P(ZC≤Z|μ=μ0)

右侧检验 H0:μ≤μ0H0:μ≤μ0 vs H1:μ>μ0H1:μ>μ0

P值是当μ=μ0μ=μ0时,检验统计量大于或等于根据实际观测样本数据计算得到的检验统计量值的概率,即p值 = P(ZC≥Z|μ=μ0)P(ZC≥Z|μ=μ0)

双侧检验 H0:μ=μ0H0:μ=μ0 vs H1:μ≠μ0H1:μ≠μ0

P值是当μ=μ0μ=μ0时,检验统计量大于或等于根据实际观测样本数据计算得到的检验统计量值的概率,即p值 = 2P(ZC≥|Z||μ=μ0)2P(ZC≥|Z||μ=μ0)

三、P值的意义

P值就是当原假设为真时所得到的样本观察结果或更极端结果出现的概率。如果P值很小,说明这种情况的发生的概率很小,而如果出现了,根据小概率原理,我们就有理由拒绝原假设,P值越小,我们拒绝原假设的理由越充分。

总之,P值越小,表明结果越显著。但是检验的结果究竟是“显著的”、“中度显著的”还是“高度显著的”需要我们自己根据P值的大小和实际问题来解决。

时间: 2024-11-05 12:34:37

P值,“差异具有显著性”和“具有显著差异”的相关文章

fold change(差异倍数), P-value(差异的显著性)

fold change的意思是样本质检表达量的差异倍数,log2 fold change的意思是取log2,这样可以可以让差异特别大的和差异比较小的数值缩小之间的差距.Q-value,是P-value校正值,P值是统计差异的显著性的.Q值比P值更严格的一种统计. The mean UMI counts per cell of this gene in cluster iThe log2 fold-change of this gene's expression in cluster i rela

四种比较简单的图像显著性区域特征提取方法原理及实现-----&gt; AC/HC/LC/FT。

laviewpbt  2014.8.4 编辑 Email:[email protected]   QQ:33184777 最近闲来蛋痛,看了一些显著性检测的文章,只是简单的看看,并没有深入的研究,以下将研究的一些收获和经验共享. 先从最简单的最容易实现的算法说起吧: 1. LC算法 参考论文:Visual Attention Detection in Video Sequences Using Spatiotemporal Cues. Yun Zhai and Mubarak Shah.  Pa

四种简单的图像显著性区域特征提取方法-----&gt; AC/HC/LC/FT。

四种简单的图像显著性区域特征提取方法-----> AC/HC/LC/FT. 分类: 图像处理 2014-08-03 12:40 4088人阅读 评论(4) 收藏 举报 salient region detec显著性检测 laviewpbt  2014.8.3 编辑 Email:[email protected]   QQ:33184777 最近闲来蛋痛,看了一些显著性检测的文章,只是简单的看看,并没有深入的研究,以下将研究的一些收获和经验共享.      先从最简单的最容易实现的算法说起吧: 1

对比文件MD5差异并保存

参考 http://www.cnblogs.com/flying_bat/archive/2007/09/25/905133.html http://www.cnblogs.com/Sniper-quay/archive/2011/04/23/2025643.html http://www.2cto.com/kf/201501/367905.html http://blog.csdn.net/hqw7286/article/details/5603442 http://jingyan.baidu

(转)Oracle与DB2在数据库高可用技术上的相同与差异探讨

原文:http://www.talkwithtrend.com/Article/178339 数据库建设过程中,高可用是每一个企业数据中心数据库建设过程中至关重要的一个关注点,直接关系到业务连续性和稳定性.要想将这个工作做好,我们必须从其底层原理.机制.架构等方面进行深入了解,深入分析,深入对比才能知道我们应该如何去实践.下面的几个关键点,不仅仅是每一个DBA应该琢磨的事情,同时也是搞企业IT架构规划和建设的人必须了解和知道的事情. 下面总结了一些Oracle与DB2在数据库高可用技术上的相同与

difflib文件差异对比

1.两个字符串差异对比: #!/usr/bin/env python # -*- coding:utf-8 -*- import difflib text1 = '''text1: This module provides classes and functions for comparing sequences. including HTML and context and unified diffs. difflib document v7.4 add string ''' text1_li

既显示差异又显示相同Beyond Compare 如何做到

Beyond Compare是一款功能强大并且非常好用的文件夹以及文件对比工具,在使用Beyond Compare软件进行文件夹对比的时候,是否发现点击显示差异时,界面中只显示存在差异的文件,那么如何设置才能同时也显示出其他无差异的文件呢?接下来小编就和大家简单介绍一下,如何实现这一便捷操作. 步骤一:打开Beyond Compare软件,单击文件夹比较会话,浏览选择需要对比的文件.单击"显示差异"按钮,查看对比文件的不同之处,差异结果如下图所示.  对比文件夹差异图例 步骤二:图例显

emacs中对比文件的差异ediff

01-02-01) ediff-buffers/ediff-files 比较当前已经打开的2个文件缓冲区A/B中的文件内容.文件内容不一致的行(或不一致的上下行.多行)或作为一个差异区域,高亮显示. A或B窗口中显示的增量部分,将显示为红色:如果将A的增量替换到B窗口后,B中的替换增加部分会显示为绿色. A与B窗口同一行或多行有差异时,A与B的窗口都将加上白色高亮背景:同时A窗口中字符颜色为红色,而B窗口字符颜色为蓝色(估计是绿色加上白色背景后的重叠,等于蓝色了) 用按键j或者n/p移动光标至差

Hyper-v使用差异磁盘创建虚拟机

使用差异磁盘创建虚拟机的好处 1.节省物理磁盘的空间 2.快速的创建多个虚拟机 生产环境中不建议使用,主要是在测试环境中使用,其使用过程中母盘需关闭,母盘挂了就完蛋了. 其实这里的方法跟vmware workstation中的链接克隆是差不多的,在vmware workstation中我们为了在测试环境中快速创建虚拟机,那么我们也可以先对虚拟机进行sysprep然后关机,作为模板.其它的虚拟机则使用链接的克隆,这样我们就可以快速的创建多个虚拟机来进行测试了. 准备创建多个2003的虚拟机,首先,