统计板块一随机抽样学生版Word文件下载.docx

上传人:b****1 文档编号:15257016 上传时间:2022-10-28 格式:DOCX 页数:14 大小:268.55KB
下载 相关 举报
统计板块一随机抽样学生版Word文件下载.docx_第1页
第1页 / 共14页
统计板块一随机抽样学生版Word文件下载.docx_第2页
第2页 / 共14页
统计板块一随机抽样学生版Word文件下载.docx_第3页
第3页 / 共14页
统计板块一随机抽样学生版Word文件下载.docx_第4页
第4页 / 共14页
统计板块一随机抽样学生版Word文件下载.docx_第5页
第5页 / 共14页
点击查看更多>>
下载资源
资源描述

统计板块一随机抽样学生版Word文件下载.docx

《统计板块一随机抽样学生版Word文件下载.docx》由会员分享,可在线阅读,更多相关《统计板块一随机抽样学生版Word文件下载.docx(14页珍藏版)》请在冰豆网上搜索。

统计板块一随机抽样学生版Word文件下载.docx

系统抽样适用于大规模的抽样调查,由于抽样间隔相等,又被称为等距抽样.

⑶分层抽样:

当总体有明显差别的几部分组成时,要反映总体情况,常采用分层抽样,使总体中各个个体按某种特征分成若干个互不重叠的几部分,每一部分叫做层,在各层中按层在总体中所占比例进行简单随机抽样,这种抽样方法叫做分层抽样.

分层抽样的样本具有较强的代表性,而且各层抽样时,可灵活选用不同的抽样方法,应用广泛.

2.简单随机抽样必须具备下列特点:

⑴简单随机抽样要求被抽取的样本的总体个数是有限的.

⑵简单随机样本数小于等于样本总体的个数.

⑶简单随机样本是从总体中逐个抽取的.

⑷简单随机抽样是一种不放回的抽样.

⑸简单随机抽样的每个个体入样的可能性均为.

3.系统抽样时,当总体个数恰好是样本容量的整数倍时,取;

若不是整数时,先从总体中随机地剔除几个个体,使得总体中剩余的个体数能被样本容量整除.因为每个个体被剔除的机会相等,因而整个抽样过程中每个个体被抽取的机会仍然相等,为.

二.频率直方图

列出样本数据的频率分布表和频率分布直方图的步骤:

①计算极差:

找出数据的最大值与最小值,计算它们的差;

②决定组距与组数:

取组距,用决定组数;

③决定分点:

决定起点,进行分组;

④列频率分布直方图:

对落入各小组的数据累计,算出各小数的频数,除以样本容量,得到各小组的频率.

⑤绘制频率分布直方图:

以数据的值为横坐标,以的值为纵坐标绘制直方图,

知小长方形的面积=组距×

=频率.

频率分布折线图:

将频率分布直方图各个长方形上边的中点用线段连接起来,就得到频率分布折线图,一般把折线图画成与横轴相连,所以横轴左右两端点没有实际意义.

总体密度曲线:

样本容量不断增大时,所分组数不断增加,分组的组距不断缩小,频率分布直方图可以用一条光滑曲线来描绘,这条光滑曲线就叫做总体密度曲线.总体密度曲线精确地反映了一个总体在各个区域内取值的规律.

三.茎叶图

制作茎叶图的步骤:

①将数据分为“茎”、“叶”两部分;

②将最大茎与最小茎之间的数字按大小顺序排成一列,并画上竖线作为分隔线;

③将各个数据的“叶”在分界线的一侧对应茎处同行列出.

四.统计数据的数字特征

用样本平均数估计总体平均数;

用样本标准差估计总体标准差.

数据的离散程序可以用极差、方差或标准差来描述.

极差又叫全距,是一组数据的最大值和最小值之差,反映一组数据的变动幅度;

样本方差描述了一组数据平均数波动的大小,样本的标准差是方差的算术平方根.

一般地,设样本的元素为样本的平均数为,

定义样本方差为,

样本标准差

简化公式:

五.独立性检验

1.两个变量之间的关系;

常见的有两类:

一类是确定性的函数关系;

另一类是变量间存在关系,但又不具备函数关系所要求的确定性,它们的关系是带有一定随机性的.当一个变量取值一定时,另一个变量的取值带有一定随机性的两个变量之间的关系叫做相关关系.

2.散点图:

将样本中的个数据点描在平面直角坐标系中,就得到了散点图.

散点图形象地反映了各个数据的密切程度,根据散点图的分布趋势可以直观地判断分析两个变量的关系.

3.如果当一个变量的值变大时,另一个变量的值也在变大,则这种相关称为正相关;

此时,散点图中的点在从左下角到右上角的区域.

反之,一个变量的值变大时,另一个变量的值由大变小,这种相关称为负相关.此时,散点图中的点在从左上角到右下角的区域.

散点图可以判断两个变量之间有没有相关关系.

4.统计假设:

如果事件与独立,这时应该有,用字母表示此式,即,称之为统计假设.

5.(读作“卡方”)统计量:

统计学中有一个非常有用的统计量,它的表达式为,用它的大小可以用来决定是否拒绝原来的统计假设.如果的值较大,就拒绝,即认为与是有关的.

统计量的两个临界值:

、;

当时,有的把握说事件与有关;

当时,认为事件与是无关的.

独立性检验的基本思想与反证法类似,由结论不成立时推出有利于结论成立的小概率事件发生,而小概率事件在一次试验中通常是不会发生的,所以认为结论在很大程度上是成立的.

1.独立性检验的步骤:

统计假设:

列出联表;

计算统计量;

查对临界值表,作出判断.

2.几个临界值:

联表的独立性检验:

如果对于某个群体有两种状态,对于每种状态又有两个情况,这样排成一张的表,如下:

状态

合计

如果有调查得来的四个数据,并希望根据这样的个数据来检验上述的两种状态与是否有关,就称之为联表的独立性检验.

六.回归分析

1.回归分析:

对于具有相关关系的两个变量进行统计分析的方法叫做回归分析,即回归分析就是寻找相关关系中这种非确定关系的某种确定性.

回归直线:

如果散点图中的各点都大致分布在一条直线附近,就称这两个变量之间具有线性相关关系,这条直线叫做回归直线.

2.最小二乘法:

记回归直线方程为:

,称为变量对变量的回归直线方程,其中叫做回归系数.

是为了区分的实际值,当取值时,变量的相应观察值为,而直线上对应于的纵坐标是.

设的一组观察值为,,且回归直线方程为,

当取值时,的相应观察值为,差刻画了实际观察值与回归直线上相应点的纵坐标之间的偏离程度,称这些值为离差.

我们希望这个离差构成的总离差越小越好,这样才能使所找的直线很贴近已知点.

记,回归直线就是所有直线中取最小值的那条.

这种使“离差平方和为最小”的方法,叫做最小二乘法.

用最小二乘法求回归系数有如下的公式:

,,其中上方加“”,表示是由观察值按最小二乘法求得的回归系数.

3.线性回归模型:

将用于估计值的线性函数作为确定性函数;

的实际值与估计值之间的误差记为,称之为随机误差;

将称为线性回归模型.

产生随机误差的主要原因有:

①所用的确定性函数不恰当即模型近似引起的误差;

②忽略了某些因素的影响,通常这些影响都比较小;

③由于测量工具等原因,存在观测误差.

4.线性回归系数的最佳估计值:

利用最小二乘法可以得到的计算公式为

,,其中,

由此得到的直线就称为回归直线,此直线方程即为线性回归方程.其中,分别为,的估计值,称为回归截距,称为回归系数,称为回归值.

5.相关系数:

6.相关系数的性质:

⑴;

⑵越接近于1,的线性相关程度越强;

⑶越接近于0,的线性相关程度越弱.

可见,一条回归直线有多大的预测功能,和变量间的相关系数密切相关.

7.转化思想:

根据专业知识或散点图,对某些特殊的非线性关系,选择适当的变量代换,把非线性方程转化为线性回归方程,从而确定未知参数.

8.一些备案

①回归(regression)一词的来历:

“回归”这个词英国统计学家FrancilsGalton提出来的.1889年,他在研究祖先与后代的身高之间的关系时发现,身材较高的父母,他们的孩子也较高,但这些孩子的平均身高并没有他们父母的平均身高高;

身材较矮的父母,他们的孩子也较矮,但这些孩子的平均身高却比他们父母的平均身高高.Galton把这种后代的身高向中间值靠近的趋势称为“回归现象”.后来,人们把由一个变量的变化去推测另一个变量的变化的方法称为回归分析.

②回归系数的推导过程:

把上式看成的二次函数,的系数,

因此当时取最小值.

同理,把的展开式按的降幂排列,看成的二次函数,当时取最小值.

解得:

,,

其中,是样本平均数.

9.对相关系数进行相关性检验的步骤:

①提出统计假设:

变量不具有线性相关关系;

②如果以的把握作出推断,那么可以根据与(是样本容量)在相关性检验的临界值表中查出一个的临界值(其中称为检验水平);

③计算样本相关系数;

④作出统计推断:

若,则否定,表明有的把握认为变量与之间具有线性相关关系;

若,则没有理由拒绝,即就目前数据而言,没有充分理由认为变量与之间具有线性相关关系.

说明:

⑴对相关系数进行显著性检验,一般取检验水平,即可靠程度为.

⑵这里的指的是线性相关系数,的绝对值很小,只是说明线性相关程度低,不一定不相关,可能是非线性相关的某种关系.

⑶这里的是对抽样数据而言的.有时即使,两者也不一定是线性相关的.故在统计分析时,不能就数据论数据,要结合实际情况进行合理解释.

典例分析

题型一系统抽样

【例1】已知某商场新进3000袋奶粉,为检查其三聚氰胺是否超标,现采用系统抽样的方法从中抽取150袋检查,若第一组抽出的号码是11,则第六十一组抽出的号码为.

【例2】某校高三年级195名学生已编号为1,2,3,…195,为了解高三学生的饮食情况,要按的比例抽取一个样本,若采用系统抽样方法进行抽取,其中抽取3名学生的编号可能是()

A.3,24,33B.31,47,147C.133,153,193D.102,132,159

【例3】从编号为的枚最新研制的某种型号的导弹中随机抽取枚来进行发射实验,若采用每部分选取的号码间隔一样的系统抽样方法,则所选取枚导弹的编号可能是()

A.B.C.D.

【例4】有件产品,编号从至,现在从中抽取件检验,用系统抽样法所抽的编号可能为(  )

A.  B.

C.  D.

【例5】采用系统抽样法,从人中抽取一个容量为人的样本,写出抽样的步骤,并求每人被抽取的机率.

【例6】用系统抽样法要从160名学生中抽取容量为20的样本,将160名学生随机地从1~160编号,按编号顺序平均分成20组(号,号,…,号),若第16组抽出的号码为126,则第1组中用抽签的方法确定的号码是___________.

【例7】某单位有工程师人,技术员人,技工人,要从这些人中抽取一个容量为的样本;

如果采用系统抽样和分层抽样方法抽取,不用剔除个体;

如果样本容量增加个,则在采用系统抽样时,需要在总体中先剔除个个体,则样本容量为______.

【例8】一个总体中有个个体,随机编号,,,…,,依编号顺序平均分成个小组,组号依次为,,,…,.现用系统抽样方法抽取一个容量为的样本,规定如果在第组随机抽取的号码为,那么在第组中抽取的号码个位数字与的个位数字相同,若,则在第组中抽取的号码是.

题型二分层抽样

【例9】(2010朝阳二模)

某校共有学生2000名,各年级男、女学生人数如下表,已知在全校学生中随机抽取1名,抽到二年级女生的概率是,现用分层抽样的方法在全校学生中抽取64人,则应在三年级抽取的学生人数为(  )

一年级

二年级

三年级

女生

385

男生

375

360

A.

展开阅读全文
相关资源
猜你喜欢
相关搜索

当前位置:首页 > 初中教育 > 数学

copyright@ 2008-2022 冰豆网网站版权所有

经营许可证编号:鄂ICP备2022015515号-1