2017年福州大学经济与管理学院886统计学综合考研冲刺密押题
● 摘要
一、简答题
1. 什么是同度量因素?同度量因素在编制加权综合指数中有什么作用?
【答案】在统计学中,一般把相乘以后使得不能直接相加的指标过渡到可以直接相加的指标的那个因素,称为同度量因素或同度量系数。
在编制指数时,对于不能直接相加的指标,可通过同度量因素把指标过渡到具有可加性。
2. 简述统计分组的原则。
【答案】采用组距分组时,需要遵循不重不漏的原则。不重是指一项数据只能分在其中的某一组,不能在其他组 中重复出现;不漏是指组别能够穷尽。即在所分的全部组别中每项数据都能分在其中的某一组,不能遗漏。
为解决不重的问题,统计分组时习惯上规定“上组限不在内”。即当相邻两组的上下限重叠时,恰好等于某 一组上限的变量值不算在本组内,而计算在下一组内。而对于连续变量,可以采取相邻两组组限重叠的方法,根 据“上组限不在内”的规定解决不重的问题,也可以对一个组的上限值采用小数点的形式,小数点的位数根据所 要求的精度具体确定。
3. 统计分组标志选择的原则。
【答案】在进行统计分组标志选择时要遵循三个原则:
(1)应根据研宄目的与任务选择分组标志。同一研宄总体,研宄的目的不同,可选用的分组标志也不同。
(2)要选用能反映事物本质或主要特征的标志。一般情况下,社会经济现象有多种特征,在选择分组标志 时,可以使用这种标志,也可以选择另一种标志,这就需要根据被研究对象的特征,选择主要的、能抓住事物本 质的标志进行分组。
(3)要根据现象所处的历史条件及经济条件来选择标志。由于社会是不断发展的,在不同的历史条件与经 济条件下,选择的分组标志也不一样,要根据情况的变化而变化。
4. 何谓统计量?分布、t 分布、F 分布是不是统计量?它们在统计分析中各有何用处?
【答案】设
函数
又称是从总体X 中抽取的容量为n 的一个样本,如果由此样本构造一个不依赖于任何未知参数,则称函数为样本统计量。当获得样本的一组具体观测值
第 2 页,共 46 页 是一个统计量。通常,时,代入T ,计算
出的数值,就获得一个具体的统计量值。
从以上统计量的定义可以看出,当. 分布、t 分布、F 分布是由样本构造的函数,而且不依
分布、t 分布、F 分布中含有分布、t 分布、F 分布就是统计量;若赖于任何未知参数时,则.
未知参数,则它们就不是统计量。
分布:分布可以用来构造f 分布与F 分布,并且在假设检验与列联分析中做检验统计量。
t 分布:一般当时,f 分布与标准正态分布就非常接近。分布的诞生对于统计学中小样本理论和应用有着重要的促进作用。f 分布在假设检验与线性回归显著性检验中做检验统计量。
F 分布:在比较两个总体方差的假设检验时通常用F 分布,且F 分布在线性回归显著性检验与方差分析中做很重要的检验统计量。
5. 下列调查问卷中的提问都有问题,请修改。
(1)您和您爱人是否对现有住房满意?
(2)您最近一次是几点上班的?
(3)绝大多数喝过明光牛奶的人都认为它口味纯正,您认为是这样的吗?
【答案】(1)您对现有住房满意吗?您爱人呢?
(2)您最近一次的工作是几点上班?
(3)您认为明光牛奶的口味纯正吗?
6. 简述标准化值的意义及计算公式。
【答案】变量值与其平均数的离差除以标准差后的值称为标准分数,也称标准化值或分数。其计算公式为:
标准差。
标准分数可以测量每个数据在该组数据中的相对位置,并可以用它来判断一组数据是否有离群数据。比如, 如果某个数值的标准分数为就知道该数值低于平均数1.5倍的标准差。在对多个具有不同量纲的变量进行处理时,常常需要对各变量进行标准化处理。实际上,z 分数只是将原始数据进行了线性变换,它并没有改变一个数据在该组数据中的位置,也没有改变该组数据分布的形状,而只是将该组数据变为平均数为0, 标准差为1。
7. 解释多重判定系数和调整的多重判定系数的含义和作用。
【答案】(1)多重判定系数是多元回归中的回归平方和占总平方和的比例,它是度量多元回归方程拟合程度的一个统计量,反映了在因变量y 的变差中被估计的回归方程所解释的比例,其计算公式为 式中为变量的标准化值,是该组数据均值,s 为该组数据的
(2)调整的多重判定系数考虑了样本量(n )和模型中自变量的个数(k )的影响,这就使得
的值永远小于
而且的值不会由于模型中自变量个数的增加而越来越接近1,其计算公式为
第 3 页,共 46 页
8. 全概率公式与逆概率公式分别用于什么场合?
【答案】(1)全概率公式为:
其中,是互不相容的事件且
如果对于某一复杂事件A 的概率,能够构造合适的完备事件组,使得这些事件的概率和给定这些事件下A 的条件概率较易于确定,就可以用全概率公式。
(2)逆概率公式也称贝叶斯公式,即
式中:
发生概率。
表示完备事件组。 中每个事件的逆概率公式是要在事件A 已经发生的条件下来计算完备事件组
二、计算题
9. 某大学为了答学生每天上网的时间,在全校7500名学生中采取重复抽样方法随机抽取36人,调查他们每天上网的时间,得到下面的数据(单位:小时):
求该校大学生平均上网时间的置信区间,置信水平为95%
准正态分布,即
【答案】抽取的样本容量n = 36为大样本,因此样本均值经过标准化以后的随机变量服从标
此时可用样本方差代替总体方差,则总体均值在置信水平为95%下的置信区间为:
根据表格中的数据可求得:
代入数据可得该校大学生平均上网时间在置信水平为95%下的置信区间为:(2.8, 3.8)。
第 4 页,共 46 页