样本方差计算公式(总体方差和样本方差计算公式)

一、方差(variance):衡量随机变量或一组数据时离散程度的度量。

概率论中方差用来度量随机变量和其数学期望(即均值)之间的偏离程度。

统计中的方差(样本方差)是每个样本值与全体样本值的平均数之差的平方值的平均数。

概率论中的方差表示方法 :

样本方差,无偏估计、无偏方差(unbiased variance)。对于一组随机变量,从中随机抽取N个 样本,这组样本的方差就 是Xi^2平方和除以N-1。

样本方差计算公式(总体方差和样本方差计算公式)

总体方差,也叫做有偏估计,其实就是我们从初高中就学到的那个标准定义的方差,除数是N。

样本方差计算公式(总体方差和样本方差计算公式)

统计中的方差表示方法 :

样本方差计算公式(总体方差和样本方差计算公式)

样本方差计算公式(总体方差和样本方差计算公式)

二、为什么样本方差的分母是n-1?为什么它又叫做无偏估计?

简单的回答,是因为因为均值你已经用了n个数的平均来做估计在求方差时,只有(n-1)个数和均值信息是不相关的。

而你的第n个数已经可以由前(n-1)个数和均值来唯一确定,实际上没有信息量。所以在计算方差时,只除以(n-1)。

那么更严格的证明呢?

样本方差计算公式里分母为n-1的目的是为了让方差的估计是无偏的。

无偏的估计(unbiased estimator)比有偏估计(biased estimator)更好是符合直觉的,尽管有的统计学家认为让mean square error即MSE最小才更有意义,这个问题我们不在这里探讨;

不符合直觉的是,为什么分母必须得是n-1而不是n才能使得该估计无偏。

首先,我们假定随机变量的数学期望是已知的,然而方差未知。在这个条件下,根据方差的定义我们有

样本方差计算公式(总体方差和样本方差计算公式)

由此可得

样本方差计算公式(总体方差和样本方差计算公式)

这个结果符合直觉,并且在数学上也是显而易见的。

现在,我们考虑随机变量

样本方差计算公式(总体方差和样本方差计算公式)

样本方差计算公式(总体方差和样本方差计算公式)

样本方差计算公式(总体方差和样本方差计算公式)

三、理论推导

为了方便叙述,在这里说明好数学符号:

样本方差计算公式(总体方差和样本方差计算公式)

前面说过样本方差之所以要除以(n-1)是因为这样的方差估计量才是关于总体方差的无偏估计量。在公式上来讲的话就是样本方差的估计量的期望要等于总体方差。如下:

样本方差计算公式(总体方差和样本方差计算公式)

但是没有修正的方差公式,它的期望是不等于总体方差的

样本方差计算公式(总体方差和样本方差计算公式)

也就是说,样本方差估计量如果是用没有修正的方差公式来估计总计方差的话是有偏差的

下面给出比较好理解的公式推导过程:

样本方差计算公式(总体方差和样本方差计算公式)

也就是说,除非

样本方差计算公式(总体方差和样本方差计算公式)

否则一定会有

样本方差计算公式(总体方差和样本方差计算公式)

需要注意的是不等式右边的才是的对方差的“正确”估计,但是我们是不知道真正的总体均值是多少的,只能通过样本的均值来代替总体的均值。

所以样本方差估计量如果是用没有修正的方差公式来估计总计方差的话是会有偏差,是会低估了总体的样本方差的。为了能无偏差的估计总体方差,所以要对方差计算公式进行修正,修正公式如下:

样本方差计算公式(总体方差和样本方差计算公式)

这种修正后的估计量将是总体方差的无偏估计量,下面将会给出这种修正的一个来源;

为了能搞懂这种修正是怎么来的,首先我们得有下面几个等式:

1.方差计算公式:

样本方差计算公式(总体方差和样本方差计算公式)

2. 均值的均值、方差计算公式:

样本方差计算公式(总体方差和样本方差计算公式)

对于没有修正的方差计算公式我们有:

样本方差计算公式(总体方差和样本方差计算公式)

因为:

样本方差计算公式(总体方差和样本方差计算公式)

所以有:

样本方差计算公式(总体方差和样本方差计算公式)

在这里如果想修正的方差公式,让修正后的方差公式求出的方差的期望为总体方差的话就需要在没有修正的方差公式前面加上来进行修正,即:

样本方差计算公式(总体方差和样本方差计算公式)

所以就会有这样的修正公式:

样本方差计算公式(总体方差和样本方差计算公式)

而我们看到的都是修正后的最终结果:

样本方差计算公式(总体方差和样本方差计算公式)

这就解释了为什么要对方差计算公式进行修正,且为什么要这样修正。

上面的解释如果有什么错误,或者有哪些解释不正确的地方欢迎大家指正。谢谢大家。希望能对大家有点帮助。

本文部分内容来自互联网,如有疑问请与我们联系。

发布者:币侠,转转请注明出处:https://www.yfhhf.com/baike/48820.html

(0)
                       
上一篇 2022年 11月 17日 上午12:35
下一篇 2022年 11月 17日 上午12:53

相关推荐

  • 放置三国巨额12000元红包版(放置三国巨额红包版第一波网络)

    锲而不舍 金石可镂 历时16年 手抄20多部中国经典名著 足足2000多万字 这是仙桃76岁退休老党员肖炎林 生前最引以为傲的财富 在生命弥留之际 他做出一个惊人决定 70多本手抄本全部捐给国家 “他说自己没留什么遗憾,唯独放不下的就是这些手抄本。”3月25日,在肖老位于胡场镇建设街的家中,其子肖银华打开上锁的书柜,里面整整齐齐摆放着70多本手抄本。仅四大名…

    2023年 5月 2日
    2050
  • ps放大快捷键ctrl加什么(ps怎么用滚轮放大缩小图片)

    ps快捷键大全一、工具箱(多种工具共用一个快捷键的可同时按【Shift】加此快捷键选取)   矩形、椭圆选框工具 【M】 移动工具 【V】   套索、多边形套索、磁性套索 【L】   魔棒工具 【W】   裁剪工具 【C】   切片工具、切片选择工具 【K】   喷枪工具 【J】   画笔工具、铅笔工具 【B】   像皮图章、图案图章 【S】   历史画笔工…

    百科问答 2023年 2月 19日
    1740
  • 黄酒品牌排行榜前十名(黄酒品牌排行榜前十名半干型黄酒)

    黄酒品牌排行榜前十名:古越龙山 ??中国绍兴黄酒集团有限公司是中国黄酒行业头部企业,全国520户国家重点企业之一,中国酒业协会副理事长单位,中国酒业协会黄酒分会理事长单位,中国轻工业酿酒行业十强企业(第七位)。总资产70亿元,员工3500余人。由集团公司独家发起组建的浙江古越龙山绍兴酒股份有限公司,是中国黄酒行业第一家上市公司,致力于民族产业的振兴和黄酒文化…

    2023年 6月 13日
    2490
  • 区块链交易所(区块链交易所排名列表)

    前段时间有很多朋友都想知道区块链交易所是什么。今天小编特意为大家整理了相关知识来解答!还有其他网友想搞清楚区块链交易所排名列表,币侠网小编(www.yfhhf.com)现在为大家找到了相关问题的答案,接下来一起看看吧,希望能给大家带来帮助。 11月25日,上海数据交易所揭牌成立,截至目前,我国已有接近20家数据交易平台。 随着大数据、物联网、人工智能等新一代…

    百科问答 2022年 9月 17日
    3070
  • 王霜个人资料(王霜个人资料祖籍)

    有一种动力叫永不服输,有一种精神叫中国女足,逆境翻盘永不言败正是最美的姿态。 有一种精神叫中国女足精神,铿锵玫瑰永不言败。 女足精神就是这样,敢打敢拼。 王霜就是这样一个女足运动员。 5岁被遗弃 1995年1月,王霜出生在湖北省武汉市。她幸福的生活,就在5岁那一年戛然而止了。 父母离异之后,5岁的王霜就被父母遗弃了。 王霜就被姨妈和姨夫收养了,姨妈家还有一个…

    2022年 9月 1日
    1.0K0

联系我们

不接风险内容

在线咨询: QQ交谈

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信