统计学名词解释Word文档下载推荐.docx
- 文档编号:7002256
- 上传时间:2023-05-07
- 格式:DOCX
- 页数:21
- 大小:31.16KB
统计学名词解释Word文档下载推荐.docx
《统计学名词解释Word文档下载推荐.docx》由会员分享,可在线阅读,更多相关《统计学名词解释Word文档下载推荐.docx(21页珍藏版)》请在冰点文库上搜索。
2.标准误(standarderror,SE)
Excel函数
外汇术语
样本标准差
应用实例
1.选基金
2.股市分析中
3.标准差在确定企业最优资本结构中的应用
简介
标准差的意义
标准差与平均值之间的关系
标准差公式
几何学解释
Excel函数
∙外汇术语
∙样本标准差
∙应用实例
公式
标准差也被称为标准偏差,或者实验标准差,公式如图。
简单来说,标准差是一组数据平均值分散程度的一种度量。
一个较大的标准差,代表大部分数值和其平均值之间差异较大;
一个较小的标准差,代表这些数值较接近平均值。
例如,两组数的集合{0,5,9,14}和{5,6,8,9}其平均值都是7,但第二个集合具有较小的标准差。
标准差可以当作不确定性的一种测量。
例如在物理科学中,做重复性测量时,测量数值集合的标准差代表这些测量的精确度。
当要决定测量值是否符合预测值,测量值的标准差占有决定性重要角色:
如果测量平均值与预测值相差太远(同时与标准差数值做比较),则认为测量值与预测值互相矛盾。
这很容易理解,因为如果测量值都落在一定数值范围之外,可以合理推论预测值是否正确。
标准差应用于投资上,可作为量度回报稳定性的指标。
标准差数值越大,代表回报远离过去平均数值,回报较不稳定故风险越高。
相反,标准差数值越细,代表回报较为稳定,风险亦较小。
例如,A、B两组各有6位学生参加同一次语文测验,A组的分数为95、85、75、65、55、45,B组的分数为73、72、71、69、68、67。
这两组的平均数都是70,但A组的标准差为17.07分,B组的标准差为2.37分(此数据时在R统计软件中运行获得),说明A组学生之间的差距要比B组学生之间的差距大得多。
如是总体,标准差公式根号内除以n
如是样本,标准差公式根号内除以(n-1)
因为我们大量接触的是样本,所以普遍使用根号内除以(n-1)
公式意义
所有数减去其平均值的平方和,所得结果除以该组数之个数(或个数减一),再把所得值开根号,所得之数就是这组数据的标准差。
编辑本段
标准差越高,表示实验数据越离散,也就是说越不精确
反之,标准差越低,代表实验的数据越精确
离散度
标准差是反应一组数据离散程度最常用的一种量化形式,是表示精密确的最要指标。
说起标准差首先得搞清楚它出现的目的。
我们使用方法去检测它,但检测方法总是有误差的,所以检测值并不是其真实值。
检测值与真实值之间的差距就是评价检测方法最有决定性的指标。
但是真实值是多少,不得而知。
因此怎样量化检测方法的准确性就成了难题。
这也是临床工作质控的目的:
保证每批实验结果的准确可靠。
虽然样本的真实值是不可能知道的,但是每个样本总是会有一个真实值的,不管它究竟是多少。
可以想象,一个好的检测方法,基检测值应该很紧密的分散在真实值周围。
如何不紧密,那距真实值的就会大,准确性当然也就不好了,不可能想象离散度大的方法,会测出准确的结果。
因此,离散度是评价方法的好坏的最重要也是最基本的指标。
一组数据怎样去评价和量化它的离散度呢?
人们使用了很多种方法:
极差
最直接也是最简单的方法,即最大值-最小值(也就是极差)来评价一组数据的离散度。
这一方法在日常生活中最为常见,比如比赛中去掉最高最低分就是极差的具体应用。
离均差的平方和
由于误差的不可控性,因此只由两个数据来评判一组数据是不科学的。
所以人们在要求更高的领域不使用极差来评判。
其实,离散度就是数据偏离平均值的程度。
因此将数据与均值之差(我们叫它离均差)加起来就能反映出一个准确的离散程度。
和越大离散度也就越大。
但是由于偶然误差是成正态分布的,离均差有正有负,对于大样本离均差的代数和为零的。
为了避免正负问题,在数学有上有两种方法:
一种是取绝对值,也就是常说的离均差绝对值之和。
而为了避免符号问题,数学上最常用的是另一种方法--平方,这样就都成了非负数。
因此,离均差的平方和成了评价离散度一个指标。
方差(S2)
由于离均差的平方和与样本个数有关,只能反应相同样本的离散度,而实际工作中做比较很难做到相同的样本,因此为了消除样本个数的影响,增加可比性,将标准差求平均值,这就是我们所说的方差成了评价离散度的较好指标。
样本量越大越能反映真实的情况,而算数均值却完全忽略了这个问题,对此统计学上早有考虑,在统计学中样本的均差多是除以自由度(n-1),它是意思是样本能自由选择的程度。
当选到只剩一个时,它不可能再有自由了,所以自由度是n-1。
标准差(SD)
由于方差是数据的平方,与检测值本身相差太大,人们难以直观的衡量,所以常用方差开根号换算回来这就是我们要说的标准差。
在统计学中样本的均差多是除以自由度(n-1),它是意思是样本能自由选择的程度。
变异系数(CV)
标准差能很客观准确的反映一组数据的离散程度,但是对于不同的检目,或同一项目不同的样本,标准差就缺乏可比性了,因此对于方法学评价来说又引入了变异系数CV。
一组数据的平均值及标准差常常同时做为参考的依据。
在直觉上,如果数值的中心以平均值来考虑,则标准差为统计分布之一“自然”的测量。
定义公式:
标准差与平均值定义公式
1、方差s^2=[(x1-x)^2+(x2-x)^2+......(xn-x)^2]/n
2、标准差=方差的算术平方根
从几何学的角度出发,标准差可以理解为一个从n维空间的一个点到一条直线的距离的函数。
举一个简单的例子,一组数据中有3个值,X1,X2,X3。
它们可以在3维空间中确定一个点P=(X1,X2,X3)。
想像一条通过原点的直线。
如果这组数据中的3个值都相等,则点P就是直线L上的一个点,P到L的距离为0,所以标准差也为0。
若这3个值不都相等,过点P作垂线PR垂直于L,PR交L于点R,则R的坐标为这3个值的平均数:
运用一些代数知识,不难发现点P与点R之间的距离(也就是点P到直线L的距离)是。
在n维空间中,这个规律同样适用,把3换成n就可以了。
标准差与标准误的区别
标准差与标准误都是心理统计学的内容,两者不但在字面上比较相近,而且两者都是表示距离某一个标准值或中间值的离散程度,即都表示变异程度,但是两者是有着较大的区别的。
首先要从统计抽样的方面说起。
现实生活或者调查研究中,我们常常无法对某类欲进行调查的目标群体的所有成员都加以施测,而只能够在所有成员(即样本)中抽取一些成员出来进行调查,然后利用统计原理和方法对所得数据进行分析,分析出来的数据结果就是样本的结果,然后用样本结果推断总体的情况。
一个总体可以抽取出多个样本,所抽取的样本越多,其样本均值就越接近总体数据的平均值。
标准差(standarddeviation,STD)
表示的就是样本数据的离散程度。
标准差就是样本平均数方差的开平方,标准差通常是相对于样本数据的平均值而定的,通常用M±
SD来表示,表示样本某个数据观察值相距平均值有多远。
从这里可以看到,标准差收到极值的影响。
标准差越小,表明数据越聚集;
标准差越大,表明数据越离散。
标准差的大小因测验而定,如果一个测验是学术测验,标准差大,表示学生分数的离散程度大,更能够测量出学生的学业水平;
如果一个侧样测量的是某种心理品质,标准差小,表明所编写的题目是同质的,这时候的标准差小的更好。
标准差与正态分布有密切联系:
在正态分布中,1个标准差等于正态分布下曲线的68.26%的面积,1.96个标准差等于95%的面积。
这在测验分数等值上有重要作用。
标准误(standarderror,SE)
表示的是抽样的误差。
因为从一个总体中可以抽取出无多个样本,每一个样本的数据都是对总体的数据的估计。
标准误代表的就是当前的样本对总体数据的估计,标准误代表的就是样本均数与总体均数的相对误差。
标准误是由样本的标准差除以样本人数的开平方来计算的。
从这里可以看到,标准误更大的是受到样本人数的影响。
样本人数越大,标准误越小,那么抽样误差就越小,就表明所抽取的样本能够较好地代表样本。
关于这个函数在EXCEL中的STDEVP函数有详细描述,EXCEL中文版里面就是用的“标准偏差”字样。
但我国的中文教材等通常还是使用的是“标准差”。
在EXCEL中STDEVP函数是另外一种标准差,也就是总体标准差。
在繁体中文的一些地方可能叫做“母体标准差”
在R统计软件中标准差的程序为:
sum((x-mean(x))^2)/(length(x)-1)
外汇术语
标准差指统计上用于衡量一组数值中某一数值与其平均值差异程度的指标。
标准差被用来评估价格可能的变化或波动程度。
标准差越大,价格波动的范围就越广,股票等金融工具表现的波动就越大。
在excel中调用函数
“STDEV“
估算样本的标准偏差。
标准偏差反映相对于平均值(mean)的离散程度。
样本标准差
在真实世界中,除非在某些特殊情况下,不然找到一个总体的真实的标准差是不现实的。
大多数情况下,总体标准差是通过随机抽取一定量的样本并计算样本标准差估计的。
应用实例
选基金
在投资基金上,一般人比较重视的是业绩,但往往买进了
基金的算法
近期业绩表现最佳的基金之后,基金表现反而不如预期,这是因为所选基金波动度太大,没有稳定的表现。
衡量基金波动程度的工具就是标准差(StandardDeviation)。
标准差是指基金可能的变动程度。
标准差越大,基金未来净值可能变动的程度就越大,稳定度就越小,风险就越高。
比方说,一年期标准差是30%的基金,表示这类基金的净值在一年内可能上涨30%,但也可能下跌30%。
因此,如果有两只收益率相同的基金,投资人应该选择标准差较小的基金(承受较小的风险得到相同的收益),如果有两只相同标准差的基金,则应该选择收益较高的基金(承受相同的风险,但是收益更高)。
建议投资人同时将收益和风险计入,以此来判断基金。
例如,A基金二年期的收益率为36%,标准差为18%;
B基金二年期收益率为24%,标准差为8%,从数据上看,A基金的收益高于B基金,但同时风险也大于B基金。
A基金的"
每单位风险收益率"
为2(0.36/0.18),而B基金为3(0.24/0.08)。
因此,原先仅仅以收益评价是A基金较优,但是经过标准差即风险因素调整后,B基金反而更为优异。
另外,标准差也可以用来判断基金属性。
据晨星统计,今年以来股票基金的平均标准差为5.14,积配型基金的平均标准差为5.04;
保守配置型基金的平均标准差为4.86;
普通债券基金平均标准差为2.91;
货币基金平均标准差则为0.19;
由此可见,越是积极型的基金,标准差越大;
而如果投资人持有的基金标准差高于平均值,则表示风险较高,投资人不妨在观赏奥运比赛的同时,也检视一下手中的基金。
股市分析中
股票价格的波动是股票市场风险的表现,因此股票市场风险分析就是对股票市场价格波动进行分析。
波动性代表了未来价格取值的不确定性,这种不确定性一般用方差或标准差来刻画(Markowitz,1952)。
下表是中国和美国部分时段的股票统计指标,其中中国证券市场的数据由“钱龙”软件下载,美国证券市场的数据取自ECI的“WorldStockExchangeDataDisk”。
表2股票统计指标
年份
业绩表现
波动率
上证综指
标准普尔指数
标准普尔指数
1996
110.93
16.46
0.2376
O.0573
1997
-0.13
31.01
O.1188
O.0836
1998
8.94
26.67
O.0565
O.0676
1999
17.24
19.53
O.1512
0.0433
2000
43.86
-10.14
0.097
0.0421
2001
-15.34
-13.04
O.0902
O.0732
2002
-20.82
-23.37
O.0582
O.1091
通过计算可以得到:
上证综指业绩期望值≈(110.93-0.13+8.94+17.24+43.86-15.34-20.82)/7=20.67
上证波动率期望值≈0.1156
标准普尔业绩期望值≈6.7214
标准普尔波动率期望值≈0.0680
而标准差的计算公式则根据公
分析图2
式
(2)计算:
上证综指的业绩标准差
上证波动率标准差≈0.0632
标准普尔指数业绩标准差≈21.71
标准普尔波动率标准差≈0.02365
因为标准差是绝对值,不能通过标准差对中美直接进行对比,而变异系数可以直接比较。
计算可得:
上证业绩变异系数≈45.2457/20.67≈2.1889
上证波动率变异系数≈0.0632/0.1156≈0.5467
标准普尔业绩变异系数≈21.71/6.7214≈3.2299
标准普尔波动率变异系数≈0.02365/0.0680≈0.3478
通过比较可以看出上证波动率变异系数要大于标准普尔波动率变异系数,说明长期来讲中国股市稳定性相对较差,还是一个不太成熟的股票市场。
标准差在确定企业最优资本结构中的应用
资本结构指的是企业各种资金来源的比例关系,是企业筹资活动的结果。
最优资本结构是指能使企业资本成本最低且企业价值最大的资本结构;
产权比率,即借入资本与自有资本的构成比例,是反映企业资本结构的重要变量。
企业的资产由债务性资金和权益性资金组成,但其
分析图
风险等级和收益率各不相同。
根据投资组合理论,投资的多样化可以分散掉一定的风险,因此资金提供者需要决定投资于债务性资金和权益性资金的比例。
以便在权衡风险和收益的情况下保证其利益的最大化。
理论探索而外部资金提供者利益的最大化也就是企业价值的最大化,这一投资比例对于企业融资而言也就是企业的最优资本结构比例。
假定某企业的资金通过发行债券和股票两种方式获得,并且都属于风险性资产。
σ其中债券的收益率为rD,风险通过标准差σD来衡量;
股票的收益率为rE,风险为σE;
股票和债券的相关系数为pDE,协方差为COV(rD,rE);
债券所占的比重为wD,股票所占比重为WE(WD+WE=1)。
根据投资组合理论,企业外部投资者对该企业投资所获的期望收益率为E(rp)=WDE(rD)+wEE(rE),方差为
方差
1、企业债务性资金和权益性资金完全正相关,即相关系数pDE为1。
企业外部投资者获得的期望收益率为E(rp)=wDE(rD)+wEE(rE),风险标准差为σ=wDσD+wEσE,也就是组合的标准差等于各个部分标准差的加权平均值,通过投资组合不可能分散掉投资风险。
根据投资组合理论,投资组合的不同比例对于投资者而言是无差异的。
2、企业债务性资金和权益性资金完全负相关,即其相关系数为-1。
投资者获得的报酬率的期望值及其方差分别为。
根据投资组合理论,只有当投资比例大于σE/(σD+σE)时其投资组合才是有效的。
对于企业筹资而言,也即企业的权益性资金的比例大干σE/(σD+σE),企业的筹资比例才是有效的,而且当组合比例为σE/(σD+σE)时,企业的筹资组合风险为零。
3、企业债务性资金和权益性资金的相关系数大于-1小于1。
理论上,一个企业的两种筹资方式之间的相关程度较高,一方面两种筹资方式都承担系统风险,另一方面它们也承担相同的公司风险。
因此从实践来看,企业的不同筹资方式间的相关程度不可能是完全的正相关和负相关。
对于一个企业而言,债务性资金对企业有固定的要求权,权益性资金对企业只有剩余要求权,因此债务性资金的波动不可能像权益性资金的波动那么大。
同时企业的风险会同时影响企业的债务性资金和权益性资金,因此企业的债务性资金和权益性资金的相关系数不可能为负数。
企业不同的筹资方式间的相关系数一般在0-1之间。
那么究竟在什么比例下企业的价值才会达到最大呢?
根据投资组合理论,当E(r1)>
E(r2),且
方差3
时,才能出现r1,优于r2。
可见,决定企业资本结构的直接因素主要是不同筹资方式的收益率和风险以及它们之间的相关系数。
开放分类:
统计学,经济学,项目评估理论与方法,不确定性分析,药理统计
标准误差
standarderror
定义:
样本统计量的标准差。
在相同测量条件下进行的测量称为等精度测量,例如在同样的条件下,用同一个游标卡尺测量铜棒的直径若干次,这就是等精度测量。
对于等精度测量来说,还有一种更好的表示误差的方法,就是标准误差。
标准误差定义为各测量值误差的平方和的平均值的平方根,故又称为均方误差的平方根。
计算方法
相关提示
计算方法
设n个测量值的误差为ε1、ε2……εn,则这组测量值的标准误差σ等于,见图1。
由于被测量的真值是未知数,各测量值的误差也都不知道,因此不能按上式求得标准误差。
测量时能够得到的是算术平均值,它最接近真值(N),而且也容易算出测量值和算术平均值之
图1
差,称为残差(记为v)。
理论分析表明①可以用残差v表示有限次(n次)观测中的某一次测量结果的标准误差σ,其计算公式见图2。
图2
对于一组等精度测量(n次测量)数据的算术平均值,其误差应该更小些。
理论分析表明,它的算术平均值的标准误差(有的书中或计算器上用符号s表示)与一次测量值的标准误差σ之间的关系式见图3。
图3
需要注意的是,标准误差不是测量值的实际误差,也不是误差范围,它只是对一组测量数据可靠性的估计。
标准误差小,测量的可靠性大一些,反之,测量就不大可靠。
进一步的分析表明,根据偶然误差的高斯理论,当一组测量值的标准误差为σ时,则其中的任何一个测量值的误差εi有68.3%的可能性是在(-σ,+σ)区间内。
扩展阅读:
∙1
科学,数学,标准,遗传学,误差
标准偏差
概述
语法
说明
标准偏差的计算步骤
例子
标准偏差与标准差的区别
概述
公式表达
标准偏差(StdDev,StandardDeviation)-统计学名词。
一种量度数据分布的分散程度之标准,用以衡量数据值偏离算术平均值的程度。
标准偏差越小,这些值偏离平均值就越少,反之亦然。
标准偏差的大小可通过标准偏差与平均值的倍率关系来衡量。
标准偏差公式:
S=Sqrt[(∑(xi-x拨)^2)/(N-1)]公式中∑代表总和,x拨代表x的均值,^2代表二次方,Sqrt代表平方根。
例:
有一组数字分别是200、50、100、200,求它们的标准偏差。
x拨=(200+50+100+200)/4=550/4=137.5
S^2=[(200-137.5)^2+(50-137.5)^2+(100-137.5)^2+(200-137.5)^2]/(4-1)
标准偏差S=Sqrt(S^2)
STDEV基于样本估算标准偏差。
标准偏差反映数值相对于平均值(mean)的离散程度。
语法
STDEV(number1,number2,...)
Number1,number2,...是对应于总体中的样本的1到30个数字参数。
说明
忽略逻辑值(TRUE和FALSE)和文本。
如果不能忽略逻辑值和文本,请使用STDEVA函数。
STDEV假设其参数是总体中的样本。
如果数据代表整个样本总体,则应使用函数STDEVP来计算标准偏差。
此处标准偏差的计算使用“无偏差”或“n-1”方法。
STDEV的计算公式如下:
标准偏差的计算步骤
标准偏差的计算步骤是:
步骤一、(每个样本数据-样本全部数据之平均值)。
步骤二、把步骤一所得的各个数值相加。
步骤三、把步骤二的结果除以(n-1)(“n”指样本数目)。
步骤四、从步骤三所得的数值之平方根就是抽样的标准偏差。
例子
假设有10件工具在制造过程中是由同一台机器制造出来的,并取样为随机样本进行断裂强度测量。
St1
St2
St3
St4
St5
St6
St7
St8
St9
St10
说明(结果)
1345
1301
1368
1322
1310
1370
1318
1350
1303
1299
=STDEV([St1],[St2],[St3],[St4]
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 统计学 名词解释