样本方差与总体方差

样本方差与总体方差样本方差与总体方差 一 方差 variance 衡量随机变量或一组数据时离散程度的度量 nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp 概率论中方差用来度量随机变量和其数学期望 即均值 之间的偏离程度 nbsp 统计中的方差 样本方差 是每个样本值与全体样本值的平均数之差的平方值的平均数 nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp nbsp

样本方差与总体方差

一、方差(variance):衡量随机变量或一组数据时离散程度的度量。                                

概率论中方差用来度量随机变量和其数学期望(即均值)之间的偏离程度。

 统计中的方差(样本方差)是每个样本值与全体样本值的平均数之差的平方值的平均数。                                        

概率论中的方差表示方法 :                        

样本方差,无偏估计、无偏方差(unbiased variance)。对于一组随机变量,从中随机抽取N个 样本,这组样本的方差就 是Xi^2平方和除以N-1。

样本方差与总体方差

总体方差,也叫做有偏估计,其实就是我们从初高中就学到的那个标准定义的方差,除数是N。

样本方差与总体方差

统计中的方差表示方法 :  
  
样本方差与总体方差         
样本方差与总体方差

二、为什么样本方差的分母是n-1?为什么它又叫做无偏估计?

简单的回答,是因为因为均值你已经用了n个数的平均来做估计在求方差时,只有(n-1)个数和均值信息是不相关的。

而你的第n个数已经可以由前(n-1)个数和均值来唯一确定,实际上没有信息量。所以在计算方差时,只除以(n-1)。

那么更严格的证明呢?

样本方差计算公式里分母为n-1的目的是为了让方差的估计是无偏的。

无偏的估计(unbiased estimator)比有偏估计(biased estimator)更好是符合直觉的,尽管有的统计学家认为让mean square error即MSE最小才更有意义,这个问题我们不在这里探讨;

不符合直觉的是,为什么分母必须得是n-1而不是n才能使得该估计无偏。

首先,我们假定随机变量的数学期望是已知的,然而方差未知。在这个条件下,根据方差的定义我们有

\mathbb{E}\Big[\big(X_i -\mu\big)^2 \Big]=\sigma^2, \quad\forall i=1,\ldots,n,

由此可得

\mathbb{E}\Big[\frac{1}{n} \sum_{i=1}^n\Big(X_i -\mu\Big)^2 \Big]=\sigma^2

\frac{1}{n} \sum_{i=1}^n\Big(X_i -\mu\Big)^2是方差\sigma^2的一个无偏估计,注意式中的分母不偏不倚正好是n

这个结果符合直觉,并且在数学上也是显而易见的。

现在,我们考虑随机变量X的数学期望\mu是未知的情形。这时,我们会倾向于无脑直接用样本均值\bar{X}替换掉上面式子中的\mu。这样做有什么后果呢?后果就是,

如果直接使用\frac{1}{n} \sum_{i=1}^n\Big(X_i -\bar{X}\Big)^2作为估计,那么你会倾向于低估方差!

那么,在不知道随机变量真实数学期望的前提下,如何“正确”的估计方差呢?答案是把上式中的分母n换成n-1,通过这种方法把原来的偏小的估计“放大”一点点,我们就能获得对方差的正确估计了:
\mathbb{E}\Big[\frac{1}{n-1} \sum_{i=1}^n\Big(X_i -\bar{X}\Big)^2\Big]=\mathbb{E}\Big[\frac{1}{n} \sum_{i=1}^n\Big(X_i -\mu\Big)^2 \Big]=\sigma^2.

三、理论推导

 

为了方便叙述,在这里说明好数学符号:

样本方差与总体方差

前面说过样本方差之所以要除以(n-1)是因为这样的方差估计量才是关于总体方差的无偏估计量。在公式上来讲的话就是样本方差的估计量的期望要等于总体方差。如下:

样本方差与总体方差

但是没有修正的方差公式,它的期望是不等于总体方差的

                            样本方差与总体方差

也就是说,样本方差估计量如果是用没有修正的方差公式来估计总计方差的话是有偏差的

下面给出比较好理解的公式推导过程:

样本方差与总体方差

也就是说,除非样本方差与总体方差否则一定会有

样本方差与总体方差

需要注意的是不等式右边的才是的对方差的“正确”估计,但是我们是不知道真正的总体均值是多少的,只能通过样本的均值来代替总体的均值。

所以样本方差估计量如果是用没有修正的方差公式来估计总计方差的话是会有偏差,是会低估了总体的样本方差的。为了能无偏差的估计总体方差,所以要对方差计算公式进行修正,修正公式如下:

样本方差与总体方差

这种修正后的估计量将是总体方差的无偏估计量,下面将会给出这种修正的一个来源;

为了能搞懂这种修正是怎么来的,首先我们得有下面几个等式:

1.方差计算公式:  

            样本方差与总体方差 

2. 均值的均值、方差计算公式:

             样本方差与总体方差

对于没有修正的方差计算公式我们有: 

样本方差与总体方差

因为:

                  样本方差与总体方差

所以有:

                  样本方差与总体方差

在这里如果想修正的方差公式,让修正后的方差公式求出的方差的期望为总体方差的话就需要在没有修正的方差公式前面加上来进行修正,即:

                  样本方差与总体方差
所以就会有这样的修正公式:

    样本方差与总体方差

而我们看到的都是修正后的最终结果:

                       样本方差与总体方差

这就解释了为什么要对方差计算公式进行修正,且为什么要这样修正。

上面的解释如果有什么错误,或者有哪些解释不正确的地方欢迎大家指正。谢谢大家。希望能对大家有点帮助。

 

参考:

https://blog.csdn.net/zxyhhjs2017/article/details/

https://blog.csdn.net/_/article/details/

https://blog.csdn.net/cqfdcw/article/details/

https://www.matongxue.com/madocs/607.html

https://www.matongxue.com/madocs/808.html

posted @
2018-12-08 11:59 小时候挺菜 阅读(
) 评论(
) 编辑
收藏
版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请联系我们举报,一经查实,本站将立刻删除。

发布者:全栈程序员-站长,转载请注明出处:https://javaforall.net/222271.html原文链接:https://javaforall.net

(0)
上一篇 2026年3月17日 下午4:10
下一篇 2026年3月17日 下午4:10


相关推荐

  • DDD(领域驱动设计)

    基本概念:  领域驱动设计(简称ddd)概念来源于2004年著名建模专家ericevans发表的他最具影响力的书籍:《domain-drivendesign–tacklingcomplexityintheheartofsoftware》(中文译名:领域驱动设计—软件核心复杂性应对之道)一书。,书中提出了“领域驱动设计(简称ddd)”的概念。领域驱动设…

    2022年4月4日
    50
  • LFU算法

    LFU算法LFU 算法 淘汰访问频次最低的元素 如果访问频次最低的数据有多条 则需要淘汰最旧的数据 classLFUCach 存放 key 到 val 的映射 HashMap Integer Integer keyToVal newHashMap lt gt 存放 key 到使用频次 freq 的映射 HashMap Integer Integer keyToFreq newHashMap Integer Integer Integer Integer

    2025年9月15日
    7
  • aardio消息大全

    aardio消息大全消息 就是指 Windows 发出的一个通知 告诉应用程序某个事情发生了 例如 单击鼠标 改变窗口尺寸 按下键盘上的一个键都会使 Windows 发送一个消息给应用程序 消息本身是作为一个记录传递给应用程序的 这个记录中包含了消息的类型以及其他信息 例如 对于单击鼠标所产生的消息来说 这个记录中包含了单击鼠标时的坐标 对于一般的点按控件的用户操作 通过创建事件响应函数就可以处理了 在窗体设计器里 直接

    2026年3月18日
    2
  • 织梦dedecms如何去除版权中的Power by DedeCms

    织梦dedecms如何去除版权中的Power by DedeCms

    2021年10月7日
    39
  • 听障解决方案实践案例|豆包的双语字幕功能!

    听障解决方案实践案例|豆包的双语字幕功能!

    2026年3月12日
    2
  • Chango的数学Shader世界(二十三)漩涡Shader-复数分析(深渊)「建议收藏」

    Chango的数学Shader世界(二十三)漩涡Shader-复数分析(深渊)「建议收藏」目的:我的2D游戏,需要一个有特定感觉的“漩涡shader”。上一节里,我简单实现了这个:但转动有些乏味,它的转动动作是类似这样的:(网图)接下来想让它动起来更加深邃,恐怖。本文先搞了2种效果:(图3,扩散瞳孔)(图4,深渊)抽象分析:前篇的Shader效果之所以看起来乏味,是因为在旋转的时候,像素点的极长(以方块中心为原点极坐标系)并没有改变,只是越接近中心,点的旋转量越小而已。(旋转前后点都在同心圆上)如果我想要深渊有“吃人”的感觉,那么内部的

    2022年6月19日
    39

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

关注全栈程序员社区公众号