当前位置:问答库>考研试题

2017年西安石油大学932统计学复试实战预测五套卷

  摘要

一、简答题

1. 下面两个统计图分别是对某数据集中y 关于x 的线性回归分析后的残差(Residuad )请指出这个回归分析所存在的问题,并提出解诀方案。

【答案】由残差图可知,两个变量之间可能为非线性关系。表明所选择的线性回归分析模型不合理,应该考虑选 用非线性模型。处理非线性回归的基本方法是,通过变量变换,将非线性回归化为线性回归,然后用线性 回归方法处理。假定根据理论或经验,已获得输出变量与输入变量之间的非线性表达式,但表达式的系 数是未知的,要根据输入输出的n 次观察结果来确定系数的值。按最小二乘法原理来求出系数值。

此外,残差连续的出现在横坐标轴的上面或下面,两个变量也可能存在正自相关问题,即线性回归模型扰动 项的方差-协方差矩阵的非主对角线的元素不全为0, 存在扰动项的自相关。可以采用检验,检验方程是否存在一阶自相关问题,或采用

或仍用检验高阶自相关问题。如果存在自相关,可以采用可行广义最小二乘法值。

2. 简述非抽样误差类型。

【答案】非抽样误差是相对抽样误差而言的,是指除抽样误差之外的,由于其他原因引起的样本观察结果与总体 真值之间的差异。无论是概率抽样、非概率抽样,或是在全面调查中,都有可能产生非抽样误差。非抽样误差有以下几种类型:

(1)抽样框误差,是指抽样框中的单位与研宄总体的单位不存在一一对应的关系,使用这样的抽样框抽取样本就会出现一些错误。

(2)回答误差,是指被调查者在接受调查时给出的回答与真实情况不符。导致回答误差的原因有多种,主要有理答误差、记忆误差和有意识误差。

(3)无回答误差,是指被调查者拒绝接受调查,调查人员得到的是一份空白的答卷。

(4)调查员误差,是指由于调查员的原因而产生的调查误差。

(5)测量误差,是指如果调查与测量工具有关,则很可能产生测量误差。

第 2 页,共 43 页 法,但使用方差-协方差矩阵的稳健估计

3. 回归分析中的误差序列有何基本假定?模型参数的最小二乘估计

模型用于预测,影响预测精度的因素有哪些? 具有哪些统计特性?若

)。独立【答案】(1

)误差项是一个服从正态分布的随机变量,且独立,即

为0的随机变量,即线性函数;②无偏性

具有最小方差的估计量。 对于所有的值分别是的方差都相同。 性意味着对于一个特定的值,它所对应的与其他值所对应的不相关。误差项是一个期望值(2

)模型参数的最小二乘估计的统计特性:①线性,即估计量的无偏估计;③有效性为随机变量的是所有线性无偏估计量中

(3)影响预测精度的因素有:①预测的信度要求。同样情况下,要求预测的把握度越高,贝_应的预测区间就越宽,精度越低;②总体y 分布的离散程度越大,相应的预测区间就越宽,预测精度越低;③样本观测点的多少n 。n 越大,相应的预测区间就越窄,预测精度越高;④样本观测点中,解释变量x 分布的离散度。x 分布越离散,预测精度越高;⑤预测点离样本分布中心的距离。预测点越远离样本分布中心预测区间越宽,精度越低,越接近样本分布中心间越窄,精度越高。

4. 何谓统计量?分布、t 分布、F 分布是不是统计量?它们在统计分析中各有何用处?

【答案】设

函数

又称出是从总体X 中抽取的容量为n 的一个样本,如果由此样本构造一个不依赖于任何未知参数,则称函数为样本统计量。当获得样本的一组具体观测值的数值,就获得一个具体的统计量值。

从以上统计量的定义可以看出,当.

赖于任何未知参数时,则.

未知参数,则它们就不是统计量。

分布:分布可以用来构造f 分布与F 分布,并且在假设检验与列联分析中做检验统计量。

t 分布:一般当时,f 分布与标准正态分布就非常接近。分布的诞生对于统计学中小样本理论和应用有着重要的促进作用。f 分布在假设检验与线性回归显著性检验中做检验统计量。

F 分布:在比较两个总体方差的假设检验时通常用F 分布,且F 分布在线性回归显著性检验与方差分析中做很重要的检验统计量。

5. 在多元线性回归中,为什么我们对整个回归方程进行检验后,还要对每个回归系数来进行检验呢?

【答案】在多元线性回归中,线性关系检验主要是检验因变量同多个自变量的线性关系是否显著,在个自变量中,只要有一个自变量与因变量的线性关系显著,F 检验就能通过,但这不一定意味着每个自变量与因变量的关系都显著。回归系数检验则是对每个回归系数分别进行单独的检验,它主要用于检验每个自变量对因变量的影响是否都显著。如果某个自变量没有通过检验,就意味着这个自变量对因变量的影响不显著,也许就没有必要将这个自变量放进回归模型中了。

第 3 页,共 43 页 区是一个统计量。通常,时,代入T ,计算分布、t 分布、F 分布是由样本构造的函数,而且不依分布、t 分布、F 分布中含有分布、t 分布、F 分布就是统计量;若

6. 什么是置信区间估计和预测区间估计?二者有何区别?

【答案】(1)置信区间估计,它是对x 的一个给定值_求出y 的平均值的估计区间,这一区间称为置信区间;预测区间估计,它是对x 的一个给定值求出y 的一个个别值的估计区间,这一区间称为预测区间。

(2)置信区间估计和预测区间估计的区别:置信区间估计是求y 的平均值的估计区间,而预测区间估计是求y 的一个个别值的估计区间;对同一个

区间要比置信区间宽一些。

这两个区间的宽度也是不一样的,预测

二、计算题

7. 抽样调查某地区50户居民的月消费品支出额数据资料,如表1所示(单位:元)。

1

要求:

(1)试根据上述资料编制频数分布表。(2)编制向上和向下累积频数、频率分布表。

【答案】(1)编制次数分布和频率分布表,如表2所示。

表2 居民户月消费品支出额频数分布和频率分布表

(2)编制向上累积和向下累积频数以及频率分布表,如表3、4所示。

表3 居民户月消费品支出额向上累积表

第 4 页,共 43 页