9.2.4 总体离散程度的估计(导学案)数学人教A版必修第二册

2026-03-02
| 2份
| 30页
| 425人阅读
| 1人下载
精品

资源信息

学段 高中
学科 数学
教材版本 高中数学人教A版必修 第二册
年级 高一
章节 9.2.4 总体离散程度的估计
类型 学案-导学案
知识点 用样本估计总体
使用场景 同步教学-新授课
学年 2026-2027
地区(省份) 全国
地区(市) -
地区(区县) -
文件格式 ZIP
文件大小 3.43 MB
发布时间 2026-03-02
更新时间 2026-03-02
作者 相思湖高中数学
品牌系列 上好课·上好课
审核时间 2026-03-02
下载链接 https://m.zxxk.com/soft/56621720.html
价格 3.00储值(1储值=1元)
来源 学科网

内容正文:

9.2.4 总体离散程度的估计 导学案 1. 理解极差、方差、标准差的概念,能准确表述其定义及公式,掌握公式的推导过程,达到数学抽象核心素养水平一的要求。 2. 掌握方差、标准差的计算方法,能熟练运用其刻画数据的离散程度,达到数据分析核心素养水平一的要求。 3. 理解分层随机抽样中总样本方差的计算原理,能结合各层样本的平均数与方差求解总样本方差,并估计总体方差。 4. 能运用离散程度指标解决实际问题,如比较数据稳定性、选择合适样本等,体会统计知识的实际应用价值,提升数学建模与逻辑推理核心素养。 教学重点: 1. 方差、标准差的概念、公式及计算; 2. 方差、标准差的统计意义与实际应用; 3. 分层随机抽样总样本方差的计算。 教学难点: 1. 方差公式的推导逻辑与“平方代替绝对值”的合理性; 2. 从样本数据中提取数字特征并合理解释其意义; 3. 分层随机抽样总方差的加权计算原理。 知识点一 一组数据的方差与标准差 假设一组数据是x1,x2,…,xn,用表示这组数据的平均数.我们称 为这组数据的方差.有时为了计算方差的方便,我们还把方差写成 的形式. 方差的算术平方根 称为这组数据的标准差. 知识点二 总体方差与总体标准差 如果总体中所有个体的变量值分别为Y1,Y2,…,YN,总体平均数为,则称 为总体方差, 为总体标准差.与总体均值类似,总体方差也可以写成加权的形式.如果总体的N个变量值中,不同的值共有k(k≤N)个,不妨记为Y1,Y2,…,Yk,其中Yi出现的频数为fi(i=1,2,…,k),则总体方差为 . 知识点三 样本方差与样本标准差 如果一个样本中个体的变量值分别为y1,y2,…,yn,样本平均数为,则称 为样本方差, 为样本标准差. 知识点四 标准差、方差描述数据的特征 标准差刻画了数据的 或 ,标准差越大,数据的离散程度 ;标准差越小,数据的离散程度 .显然,在刻画数据的分散程度上,方差和标准差是一样的.但在解决实际问题中,一般多采用标准差. 知识点五 分层随机抽样总样本的方差 设层数为2层的分层随机抽样,第1层和第2层包含的样本变量由x1,x2,…,xm及y1,y2,…,yn表示. 样本数 方差 平均数 第1层 m s 第2层 n s 则总样本的方差 s2=. 注:为总样本的平均数,即=+=. 导入新知1:超市水果甜度的“稳定”之争 学校附近有两家水果店,均主打“甜度高”的精品橙子。为了对比两家橙子的品质,小明分别在两家店各随机挑选了5个橙子,测量其甜度值(甜度值越高越甜),具体数据如下:水果店A的甜度值为12,15,8,18,7;水果店B的甜度值为13,14,12,15,11。经计算,两家店橙子的平均甜度均为12,但实际品尝后,小明发现A店的橙子甜度差异较大,有的特别甜,有的却偏酸,而B店的橙子甜度更为均匀。在推荐同学购买时,仅参考平均甜度并不全面,无法体现出两家店橙子甜度“均匀与否”的差异,这种数据之间的波动差异,需要用特定的数学方法来描述。本节课将学习刻画数据“波动程度”的工具——总体离散程度的估计,帮助大家准确描述数据差异,解决类似的实际判断问题。 1. 两家店橙子的平均甜度都是12,为什么实际品尝时,A店橙子甜度差异大、B店更均匀? 2. 仅看平均甜度无法体现数据“均匀与否”的差异,这种刻画数据“波动程度”的数学工具是什么? 3. 结合两家店橙子的甜度数据,我们该如何运用“总体离散程度的估计”,准确描述它们的甜度波动差异? 导入新知2:班级作业完成时间的“快慢差异” 班主任统计了班级20名同学完成数学家庭作业的时间(单位:分钟),并将这些数据分成两组,每组各10人。第一组同学的作业完成时间为:25,30,28,32,29,31,27,33,26,34;第二组同学的作业完成时间为:20,35,22,38,21,39,23,40,24,36。经计算,两组同学的平均完成时间均为30分钟,但老师观察发现,第一组同学的完成时间相对集中,基本能在25-35分钟内完成;第二组同学的完成时间差异较大,有的同学20分钟就能完成,有的却需要40分钟。当老师想要分析班级作业完成的“均衡性”时,仅参考平均完成时间无法体现这种快慢差异,需要特定的指标来衡量这种数据分布的分散情况。这种刻画数据分散程度的统计问题,就是我们本节课要学习的内容——总体离散程度的估计,通过本节课的学习,将帮助大家掌握衡量数据差异的方法,解决类似的实际统计问题。 1. 两组同学的平均作业完成时间都是30分钟,为什么实际观察到的完成快慢差异会如此明显? 2. 老师想分析班级作业完成的“均衡性”,衡量这种数据分布分散情况的指标,对应的是什么统计知识? 3.结合两组同学的作业完成时间数据,我们该如何运用“总体离散程度的估计”,准确衡量并描述它们的快慢差异? 平均数、中位数和众数为我们提供了一组数据的集中趋势的信息,这是概括一组数据的特征的有效方法.但仅知道集中趋势的信息,很多时候还不能使我们做出有效决策,下面的问题就是一个例子. 问题3有两位射击运动员在一次射击测试中各射靶10次,每次命中的环数如下: 甲 7 8 7 9 5 4 9 10 7 4 乙 9 5 7 8 7 6 8 6 7 7 如果你是教练,你如何对两位运动员的射击情况作出评价?如果这是一次选拔性考核,你应当如何作出选择? 通过简单的排序和计算,可以发现甲、乙两名运动员射击成绩的平均数、中位数、众数都是7.从这个角度看,两名运动员之间没有差别.但从图9.2-13中看,甲的成绩比较分散,乙的成绩相对集中,即甲的成绩波动幅度比较大,而乙的成绩比较稳定.可见,他们的射击成绩是存在差异的.那么,如何度量成绩的这种差异呢? 一种简单的度量数据离散程度的方法就是用极差.根据甲、乙运动员的10次射击成绩,可以得到 甲命中环数的极差, 乙命中环数的极差. 可以发现甲的成绩波动范围比乙的大.极差在一定程度上刻画了数据的离散程度.但因为极差只使用了数据中最大、最小两个值的信息,对其他数据的取值情况没有涉及,所以极差所含的信息量很少. 我们知道,如果射击的成绩很稳定,那么大多数的射击成绩离平均成绩不会太远;相反,如果射击的成绩波动幅度很大,那么大多数的射击成绩离平均成绩会比较远.因此,我们可以通过这两组射击成绩与它们的平均成绩的“平均距离”来度量成绩的波动幅度. 你还能想出其他刻画数据离散程度的办法吗? 思考: 如何定义“平均距离” 假设一组数据是,用表示这组数据的平均数.我们用每个数据与平均数的差的绝对值作为“距离”,即 作为到的“距离”.可以得到这组数据 到的“平均距离”为 为了避免式中含有绝对值,通常改用平方来代替,即 . (1) 我们称(1)式为这组数据的方差(variance).有时为了计算方差的方便,我们还把方差写成以下形式 可以使用计算器求一组数据的方差.需要注意的是,计算器可能按计算方差,此时需要乘进行调整. 由于方差的单位是原始数据的单位的平方,与原始数据不一致.为了使二者单位一致,我们对方差开平方,取它的算术平方根,即 (2) 我们称(2)式为这组数据的标准差(standarddeviation). 标准差的取值范围是什么?标准差为0的一组数据有什么特点? 如果总体中所有个体的变量值分别为,总体平均数为,则称 为总体方差,为总体标准差.与总体均值类似,总体方差也可以写成加权的形式.如果总体的个变量值中,不同的值共有个,不妨记为,其中出现的频数为,则总体方差为 . 如果一个样本中个体的变量值分别为,样本平均数为,则称 为样本方差,为样本标准差. 标准差刻画了数据的离散程度或波动幅度,标准差越大,数据的离散程度越大;标准差越小,数据的离散程度越小.显然,在刻画数据的分散程度上,方差和标准差是一样的.但在解决实际问题中,一般多采用标准差. 在实际问题中,总体平均数和总体标准差都是未知的.就像用样本平均数估计总体平均数一样,通常我们也用样本标准差去估计总体标准差.在随机抽样中,样本标准差依赖于样本的选取,具有随机性. 在问题3中,我们可以根据标准差来判断两名运动员的成绩的离散程度,计算可得 ,. 由可知,甲的成绩离散程度大,乙的成绩离散程度小.由此可以估计,乙比甲的射击成绩稳定. 如果要从这两名选手中选择一名参加比赛,要看一下他们的平均成绩在所有参赛选手中的位置.如果两人都排在前面,就选成绩稳定的乙选手,否则可以选甲. 平均数、中位数和众数为我们提供了一组数据的集中趋势的信息,这是概括一组数据的特征的有效方法.但仅知道集中趋势的信息,很多时候还不能使我们做出有效决策.这节课我们共同来研究总体离散趋势的有关知识. 例6在对树人中学高一年级学生身高的调查中,采用样本量比例分配的分层随机抽样,如果不知道样本数据,只知道抽取了男生23人,其平均数和方差分别为170.6和12.59,抽取了女生27人,其平均数和方差分别为160.6和38.62.你能由这些数据计算出总样本的方差,并对高一年级全体学生的身高方差作岀估计吗? 【变式】2022年2月4日—2月20日,北京冬奥会顺利召开,全民关注冬奥赛事.为了更好的普及冬奥知识,某中学举办了冬奥知识竞赛,并随机抽取了100名学生的成绩,且这100名学生的成绩(单位:分)都在,其频数分布表如下图所示. 成绩(单位:分) 人数 6 4 a b 18 由分布表得知该中学冬奥知识竞赛成绩的中位数的估计值为82分. (1)求a,b的值; (2)该中学冬奥知识竞赛成绩的平均数与标准差的估计值(同一组中的数据用该组区间的中点值为代表).(参考数据:)    1.(25-26高一上·江西上饶·期末)一组数据的平均数为7,则其方差为(    ) A. B. C. D. 2.(25-26高一上·安徽蚌埠·期末)若一组样本数据的平均数为5,方差为3,则的方差为(   ) A. B. C. D. 3.(2026·贵州六盘水·模拟预测)数据1,2,3,4,5的方差为(   ) A.1 B.2 C.3 D.4 4.(25-26高三上·黑龙江·期末)已知一组数据,,,,的平均数是,方差是,那么另一组数据,,,,的平均数和方差分别为(   ) A., B., C., D., 5.(2025高三上·江苏·学业考试)已知数据的方差为3,则数据的方差为(   ) A.3 B.6 C.9 D.12 6.(25-26高三上·全国·月考)某中学举办迎国庆歌咏比赛,邀请了七位评委,对一个选手打分后,得到一组互不相等的数据,去掉其中最高分与最低分得到的数据与原始数据一定相同的是(   ) A.平均分 B.极差 C.标准差 D.中位数 7.(2025·重庆·模拟预测)某动漫社团为了调查本校学生对新上映电影的喜好程度, 对该校学生进行了满意度调查, 其中男生共调查了 600 人,女生共调查了 400 人,男生平均给分 4 分,方差为 1 ,女生平均给分 3 分,方差也为 1 . 则调研对象总体方差为(    ) A. B. C. D. 8.(25-26高二上·云南昆明·期末)马年春节即将到来,某兴趣小组针对班里有出游计划的同学进行了随机调查,得到他们即将旅行的天数为:6,6,7,8,9,9,9,10(单位:天),则这组数据的(    ) A.极差为3 B.平均数为7 C.分位数为7.5 D.方差为2 9.(25-26高二上·浙江舟山·期末)甲在一次考试中六门课程得分分别为:87,60,76,89,90,100.则此数据的极差为(  ) A.13 B.40 C.24 D.10 10.(25-26高一上·北京延庆·期末)下图的茎叶图记录了甲、乙两名学生六次数学测验的成绩(百分制).    给出下列四个结论: ①甲同学成绩的极差比乙同学成绩的极差大; ②甲同学成绩的中位数比乙同学成绩的中位数小; ③甲同学成绩的分位数比乙同学成绩的分位数小; ④甲同学成绩的方差比乙同学成绩的方差大. 其中所有正确结论的序号是(    ). A.①④ B.①③ C.②④ D.①③④ 1.(25-26高三上·广东深圳·月考)若一组样本数据的平均数为3,方差为2,若新增一个数据3,则新样本的方差为(    ) A.1.7 B.1.8 C.1.9 D.2 2.(2025·广东广州·模拟预测)某学校高三学生共有900人,其中男生500人,为获取该校高三学生的身高信息,现采用按性别比例分配的分层随机抽样的方法,抽取了容量为90的样本.计算得男生样本的身高均值为170,方差为19,女生样本的身高均值为161,方差为19,则下列说法正确的是(    ) A.抽取男生的样本量为40 B.估计该校高三学生身高的均值为165 C.抽样时女生甲被抽到的概率为 D.估计该校高三学生身高的方差为19 3.(2026·四川巴中·一模)水稻是世界最重要的农作物之一,也是我国60%以上人口的主粮.以袁隆平院士为首的科学家研制成功的杂交水稻制种技术在世界上被誉为中国的“第五大发明”,育种技术的突破,杂交水稻的推广,不仅让中国人端稳饭碗,也为解决世界粮食短缺问题作出了巨大贡献.某农场种植的甲、乙两种水稻在面积相等的两块稻田中连续6年的产量(单位:kg)如下: 品种 第1年 第2年 第3年 第4年 第5年 第6年 甲 900 920 900 850 910 920 乙 880 860 950 830 990 890 根据以上数据,下面说法正确的是(    ). A.甲种水稻产量的平均数比乙种水稻产量的平均数大 B.甲种水稻产量的中位数比乙种水稻产量的中位数小 C.甲种水稻产量的极差与乙种水稻产量的极差相等 D.甲种水稻的产量比乙种水稻的产量稳定 4.(25-26高三上·黑龙江·月考)某中学举办迎国庆歌咏比赛,邀请了七位评委,对一个选手打分后,得到一组互不相等的数据,,,,,,,去掉其中最高分与最低分得到的数据与原始数据一定相同的是(   ) A.平均分 B.极差 C.标准差 D.中位数 1.知识清单: (1) 离散程度指标:极差(最大值-最小值,直观但片面)、方差(平方偏差的平均数)、标准差(方差的算术平方根,与原始数据单位一致)。 (2) 核心公式: 样本方差: 样本标准差: 分层随机抽样总样本方差: (3) 统计意义:方差、标准差越大,数据离散程度越大,稳定性越差;反之则越稳定。 (4) 核心思想:用样本方差、标准差估计总体离散程度。 2.方法归纳: (1) 方差、标准差的计算步骤:先求平均数→再求偏差→平方偏差→求平均→标准差(开方)。 (2) 分层随机抽样总方差:需考虑各层方差与层间偏差的影响,采用加权计算。 (3) 实际应用:综合集中趋势(平均数、中位数)与离散程度(方差、标准差)分析数据,作出合理决策。 3.常见误区: (1) 混淆样本方差与总体方差的公式(样本方差分母为n,总体方差分母为N)。 (2) 忽略标准差与原始数据单位一致的优势,误将方差作为最终描述指标。 (3) 分层随机抽样总方差计算时,遗漏层间偏差的影响,直接将各层方差平均。 (4) 仅依据方差或平均数单一指标下结论,缺乏综合分析。 4.知识拓展: 在实际问题中,大多数数据会落在区间内,这一规律可用于数据异常值的判断。 习题9. 2(第214页)第1, 2,3题 学科网(北京)股份有限公司 学科网(北京)股份有限公司 $ 9.2.4 总体离散程度的估计 导学案 1. 理解极差、方差、标准差的概念,能准确表述其定义及公式,掌握公式的推导过程,达到数学抽象核心素养水平一的要求。 2. 掌握方差、标准差的计算方法,能熟练运用其刻画数据的离散程度,达到数据分析核心素养水平一的要求。 3. 理解分层随机抽样中总样本方差的计算原理,能结合各层样本的平均数与方差求解总样本方差,并估计总体方差。 4. 能运用离散程度指标解决实际问题,如比较数据稳定性、选择合适样本等,体会统计知识的实际应用价值,提升数学建模与逻辑推理核心素养。 教学重点: 1. 方差、标准差的概念、公式及计算; 2. 方差、标准差的统计意义与实际应用; 3. 分层随机抽样总样本方差的计算。 教学难点: 1. 方差公式的推导逻辑与“平方代替绝对值”的合理性; 2. 从样本数据中提取数字特征并合理解释其意义; 3. 分层随机抽样总方差的加权计算原理。 知识点一 一组数据的方差与标准差 假设一组数据是x1,x2,…,xn,用表示这组数据的平均数.我们称__(xi-)2为这组数据的方差.有时为了计算方差的方便,我们还把方差写成x-2的形式. 方差的算术平方根__称为这组数据的标准差. 知识点二 总体方差与总体标准差 如果总体中所有个体的变量值分别为Y1,Y2,…,YN,总体平均数为,则称S2=__(Yi-)2为总体方差,S=为总体标准差.与总体均值类似,总体方差也可以写成加权的形式.如果总体的N个变量值中,不同的值共有k(k≤N)个,不妨记为Y1,Y2,…,Yk,其中Yi出现的频数为fi(i=1,2,…,k),则总体方差为S2=fi(Yi-)2. 知识点三 样本方差与样本标准差 如果一个样本中个体的变量值分别为y1,y2,…,yn,样本平均数为,则称s2=__(yi-)2为样本方差,s=为样本标准差. [提示] (1)若数据x1,x2,…,xn的平均数为,那么mx1+a,mx2+a,…,mxn+a的平均数是m+a. (2)若数据x1,x2,…,xn的方差为s2,那么 ①数据x1+a,x2+a,…,xn+a的方差也是s2; ②数据ax1,ax2,…,axn的方差是a2s2. 知识点四 标准差、方差描述数据的特征 标准差刻画了数据的离散程度或波动幅度,标准差越大,数据的离散程度越大;标准差越小,数据的离散程度越小.显然,在刻画数据的分散程度上,方差和标准差是一样的.但在解决实际问题中,一般多采用标准差. 知识点五 分层随机抽样总样本的方差 设层数为2层的分层随机抽样,第1层和第2层包含的样本变量由x1,x2,…,xm及y1,y2,…,yn表示. 样本数 方差 平均数 第1层 m s 第2层 n s 则总样本的方差 s2=. 注:为总样本的平均数,即=+=. 导入新知1:超市水果甜度的“稳定”之争 学校附近有两家水果店,均主打“甜度高”的精品橙子。为了对比两家橙子的品质,小明分别在两家店各随机挑选了5个橙子,测量其甜度值(甜度值越高越甜),具体数据如下:水果店A的甜度值为12,15,8,18,7;水果店B的甜度值为13,14,12,15,11。经计算,两家店橙子的平均甜度均为12,但实际品尝后,小明发现A店的橙子甜度差异较大,有的特别甜,有的却偏酸,而B店的橙子甜度更为均匀。在推荐同学购买时,仅参考平均甜度并不全面,无法体现出两家店橙子甜度“均匀与否”的差异,这种数据之间的波动差异,需要用特定的数学方法来描述。本节课将学习刻画数据“波动程度”的工具——总体离散程度的估计,帮助大家准确描述数据差异,解决类似的实际判断问题。 1. 两家店橙子的平均甜度都是12,为什么实际品尝时,A店橙子甜度差异大、B店更均匀? 2. 仅看平均甜度无法体现数据“均匀与否”的差异,这种刻画数据“波动程度”的数学工具是什么? 3. 结合两家店橙子的甜度数据,我们该如何运用“总体离散程度的估计”,准确描述它们的甜度波动差异? 设计意图 1. 贴近生活实际:水果甜度是学生日常消费中能直观感知的场景,容易引发共鸣,降低对抽象概念的抵触心理。 1. 制造认知冲突:通过“平均甜度相同但实际体验不同”的矛盾,让学生体会仅靠集中趋势指标(平均数)无法全面描述数据特征,进而引出“离散程度”的探究需求。 1. 锚定核心目标:情境直接指向“如何量化波动程度”,与本节课方差、标准差的核心功能高度契合,为后续知识学习搭建问题支架。 导入新知2:班级作业完成时间的“快慢差异” 班主任统计了班级20名同学完成数学家庭作业的时间(单位:分钟),并将这些数据分成两组,每组各10人。第一组同学的作业完成时间为:25,30,28,32,29,31,27,33,26,34;第二组同学的作业完成时间为:20,35,22,38,21,39,23,40,24,36。经计算,两组同学的平均完成时间均为30分钟,但老师观察发现,第一组同学的完成时间相对集中,基本能在25-35分钟内完成;第二组同学的完成时间差异较大,有的同学20分钟就能完成,有的却需要40分钟。当老师想要分析班级作业完成的“均衡性”时,仅参考平均完成时间无法体现这种快慢差异,需要特定的指标来衡量这种数据分布的分散情况。这种刻画数据分散程度的统计问题,就是我们本节课要学习的内容——总体离散程度的估计,通过本节课的学习,将帮助大家掌握衡量数据差异的方法,解决类似的实际统计问题。 1. 两组同学的平均作业完成时间都是30分钟,为什么实际观察到的完成快慢差异会如此明显? 2. 老师想分析班级作业完成的“均衡性”,衡量这种数据分布分散情况的指标,对应的是什么统计知识? 3.结合两组同学的作业完成时间数据,我们该如何运用“总体离散程度的估计”,准确衡量并描述它们的快慢差异? 设计意图 1. 贴合学生日常:作业完成时间是学生每天都会经历的场景,具有强烈的代入感,能快速吸引学生注意力。 2. 强化实际需求:通过“分析作业均衡性”的真实目的,让学生感受到刻画离散程度的实际意义,而非单纯的数学运算。 3. 串联知识体系:承接之前学习的平均数(集中趋势),自然过渡到离散程度的探究,体现统计知识“全面描述数据”的逻辑脉络,为后续综合运用集中趋势和离散程度分析问题埋下伏笔。 平均数、中位数和众数为我们提供了一组数据的集中趋势的信息,这是概括一组数据的特征的有效方法.但仅知道集中趋势的信息,很多时候还不能使我们做出有效决策,下面的问题就是一个例子. 问题3有两位射击运动员在一次射击测试中各射靶10次,每次命中的环数如下: 甲 7 8 7 9 5 4 9 10 7 4 乙 9 5 7 8 7 6 8 6 7 7 如果你是教练,你如何对两位运动员的射击情况作出评价?如果这是一次选拔性考核,你应当如何作出选择? 通过简单的排序和计算,可以发现甲、乙两名运动员射击成绩的平均数、中位数、众数都是7.从这个角度看,两名运动员之间没有差别.但从图9.2-13中看,甲的成绩比较分散,乙的成绩相对集中,即甲的成绩波动幅度比较大,而乙的成绩比较稳定.可见,他们的射击成绩是存在差异的.那么,如何度量成绩的这种差异呢? 一种简单的度量数据离散程度的方法就是用极差.根据甲、乙运动员的10次射击成绩,可以得到 甲命中环数的极差, 乙命中环数的极差. 可以发现甲的成绩波动范围比乙的大.极差在一定程度上刻画了数据的离散程度.但因为极差只使用了数据中最大、最小两个值的信息,对其他数据的取值情况没有涉及,所以极差所含的信息量很少. 我们知道,如果射击的成绩很稳定,那么大多数的射击成绩离平均成绩不会太远;相反,如果射击的成绩波动幅度很大,那么大多数的射击成绩离平均成绩会比较远.因此,我们可以通过这两组射击成绩与它们的平均成绩的“平均距离”来度量成绩的波动幅度. 你还能想出其他刻画数据离散程度的办法吗? 思考: 如何定义“平均距离” 假设一组数据是,用表示这组数据的平均数.我们用每个数据与平均数的差的绝对值作为“距离”,即 作为到的“距离”.可以得到这组数据 到的“平均距离”为 为了避免式中含有绝对值,通常改用平方来代替,即 . (1) 我们称(1)式为这组数据的方差(variance).有时为了计算方差的方便,我们还把方差写成以下形式 可以使用计算器求一组数据的方差.需要注意的是,计算器可能按计算方差,此时需要乘进行调整. 由于方差的单位是原始数据的单位的平方,与原始数据不一致.为了使二者单位一致,我们对方差开平方,取它的算术平方根,即 (2) 我们称(2)式为这组数据的标准差(standarddeviation). 标准差的取值范围是什么?标准差为0的一组数据有什么特点? 如果总体中所有个体的变量值分别为,总体平均数为,则称 为总体方差,为总体标准差.与总体均值类似,总体方差也可以写成加权的形式.如果总体的个变量值中,不同的值共有个,不妨记为,其中出现的频数为,则总体方差为 . 如果一个样本中个体的变量值分别为,样本平均数为,则称 为样本方差,为样本标准差. 标准差刻画了数据的离散程度或波动幅度,标准差越大,数据的离散程度越大;标准差越小,数据的离散程度越小.显然,在刻画数据的分散程度上,方差和标准差是一样的.但在解决实际问题中,一般多采用标准差. 在实际问题中,总体平均数和总体标准差都是未知的.就像用样本平均数估计总体平均数一样,通常我们也用样本标准差去估计总体标准差.在随机抽样中,样本标准差依赖于样本的选取,具有随机性. 在问题3中,我们可以根据标准差来判断两名运动员的成绩的离散程度,计算可得 ,. 由可知,甲的成绩离散程度大,乙的成绩离散程度小.由此可以估计,乙比甲的射击成绩稳定. 如果要从这两名选手中选择一名参加比赛,要看一下他们的平均成绩在所有参赛选手中的位置.如果两人都排在前面,就选成绩稳定的乙选手,否则可以选甲. 平均数、中位数和众数为我们提供了一组数据的集中趋势的信息,这是概括一组数据的特征的有效方法.但仅知道集中趋势的信息,很多时候还不能使我们做出有效决策.这节课我们共同来研究总体离散趋势的有关知识. 例6在对树人中学高一年级学生身高的调查中,采用样本量比例分配的分层随机抽样,如果不知道样本数据,只知道抽取了男生23人,其平均数和方差分别为170.6和12.59,抽取了女生27人,其平均数和方差分别为160.6和38.62.你能由这些数据计算出总样本的方差,并对高一年级全体学生的身高方差作岀估计吗? 解:把男生样本记为,其平均数记为,方差记为,把女生样本记为,其平均数记为,方差记为.把总样本数据的平均数记为,方差记为 根据方差的定义,总样本方差为 由,可得. 同理可得. 因此 ① 由于,,根据按比例分配分层随机抽样总样本平均数与各层样本平均数的关系,可得总样本平均数为. 把已知的男生,女生样本平均数和方差的取值代入①,可得 . 我们可以计算出总样本的方差为51.4862,并据此估计高一年级学生身高的总体方差为51.4862. 样本标准差刻画了数据离平均数波动的幅度大小,平均数和标准差一起能反映数据取值的信息.例如,根据9.2.1节中100户居民用户的月均用水量数据,可以计算出样本平均数,样本标准差, , , 如图9.2-14所示,可以发现,这100个数据中大部分落在区间内,在 外的只有7个,也就是说,绝大部分数据落在内. 【变式】2022年2月4日—2月20日,北京冬奥会顺利召开,全民关注冬奥赛事.为了更好的普及冬奥知识,某中学举办了冬奥知识竞赛,并随机抽取了100名学生的成绩,且这100名学生的成绩(单位:分)都在,其频数分布表如下图所示. 成绩(单位:分) 人数 6 4 a b 18 由分布表得知该中学冬奥知识竞赛成绩的中位数的估计值为82分. (1)求a,b的值; (2)该中学冬奥知识竞赛成绩的平均数与标准差的估计值(同一组中的数据用该组区间的中点值为代表).(参考数据:) 【答案】(1) (2)该中学冬奥知识竞赛成绩的平均数与标准差的估计值分别为81和10.2 【知识点】计算几个数据的极差、方差、标准差、计算几个数的平均数、根据频率分布表解决实际问题 【分析】(1)根据100名学生的中位数为82分,列出方程组,求出a,b的值分别为32和40; (2)根据平均数公式和标准差公式计算即可. 【详解】(1)因为该中学冬奥知识竞赛成绩的中位数的估计值为82分, 所以,解得:, 则a,b的值分别为32和40; (2)该中学冬奥知识竞赛成绩的平均数为: ; 该中学冬奥知识竞赛成绩的标准差为: . 所以. 该中学冬奥知识竞赛成绩的平均数与标准差的估计值分别为81和10.2. 【感悟提升】1..在实际问题中,仅靠平均数不能完全反映问题,还要研究方差,方差描述了数据相对平均数的离散程度. 2.在平均数相同的情况下,方差越大,离散程度越大,数据波动性越大,稳定性越差,方差越小,离散程度越小,数据越集中,越稳定.    1.(25-26高一上·江西上饶·期末)一组数据的平均数为7,则其方差为(    ) A. B. C. D. 【答案】B 【知识点】根据平均数求参数、计算几个数据的极差、方差、标准差 【分析】根据平均数及方差的计算公式计算即可. 【详解】由题意知,,解得. 故方差为: . 故选:B. 2.(25-26高一上·安徽蚌埠·期末)若一组样本数据的平均数为5,方差为3,则的方差为(   ) A. B. C. D. 【答案】A 【知识点】计算几个数据的极差、方差、标准差 【分析】根据方差和平均数的定义进行求解即可. 【详解】因为一组样本数据的平均数为5,方差为3, 所以, , 的平均数为 的方差为. 故选:A 3.(2026·贵州六盘水·模拟预测)数据1,2,3,4,5的方差为(   ) A.1 B.2 C.3 D.4 【答案】B 【知识点】计算几个数据的极差、方差、标准差 【分析】首先求出平均数,然后根据方差的计算公式即可求解. 【详解】这组数据的平均数, 所以这组数据的方差. 故选:B 4.(25-26高三上·黑龙江·期末)已知一组数据,,,,的平均数是,方差是,那么另一组数据,,,,的平均数和方差分别为(   ) A., B., C., D., 【答案】A 【知识点】各数据同时加减同一数对方差的影响 【分析】根据平均数和方差的二级结论计算. 【详解】因为数据,,,的平均数是,方差为, 则新数据,,,的平均数为:,方差为, 因为数据,,,,的平均数是,方差是, 则,,,,,的平均数是, 方差为, 故选:A. 5.(2025高三上·江苏·学业考试)已知数据的方差为3,则数据的方差为(   ) A.3 B.6 C.9 D.12 【答案】A 【知识点】各数据同时加减同一数对方差的影响 【分析】根据方差的性质求解即可. 【详解】因为数据的方差为3, 则数据的方差为. 故选:A. 6.(25-26高三上·全国·月考)某中学举办迎国庆歌咏比赛,邀请了七位评委,对一个选手打分后,得到一组互不相等的数据,去掉其中最高分与最低分得到的数据与原始数据一定相同的是(   ) A.平均分 B.极差 C.标准差 D.中位数 【答案】D 【知识点】用方差、标准差说明数据的波动程度、计算几个数据的极差、方差、标准差、计算几个数的平均数、计算几个数的中位数 【分析】根据题意由平均数、极差、标准差和中位数的定义分析可得答案. 【详解】由题意不妨设, 对于A,平均分可能变大、可能变小、可能不变,故A错误; 对于B,原始数据极差为,去掉其中最高分与最低分得到的数据极差为, 因为所以,故极差变小,故B错误; 对于C,去掉最高分和最低分后,数据的离散程度变小,故标准差变小,故C错误; 对于D,原始数据中位数为,去掉其中最高分与最低分得到的数据中位数仍为,故中位数不变,故D正确. 故选:D. 7.(2025·重庆·模拟预测)某动漫社团为了调查本校学生对新上映电影的喜好程度, 对该校学生进行了满意度调查, 其中男生共调查了 600 人,女生共调查了 400 人,男生平均给分 4 分,方差为 1 ,女生平均给分 3 分,方差也为 1 . 则调研对象总体方差为(    ) A. B. C. D. 【答案】D 【知识点】计算几个数据的极差、方差、标准差、计算几个数的平均数 【分析】根据分层平均数求出总体平均数,然后根据分层方差和总体方差的关系求解可得. 【详解】记男生平均给分为,方差为,女生平均给分为,方差为, 则, 所以总体平均数, 所以总体方差为. 故选:D 8.(25-26高二上·云南昆明·期末)马年春节即将到来,某兴趣小组针对班里有出游计划的同学进行了随机调查,得到他们即将旅行的天数为:6,6,7,8,9,9,9,10(单位:天),则这组数据的(    ) A.极差为3 B.平均数为7 C.分位数为7.5 D.方差为2 【答案】D 【知识点】计算几个数的平均数、计算几个数据的极差、方差、标准差、总体百分位数的估计 【分析】根据极差、平均数、方差及百分位数的定义求样本特征数值,即可判断各项正误. 【详解】由样本数据知极差为,故A错误; 平均数为,故B错误; 由,得这组数据的分位数是第4个数8,故C错误; 方差为,故D正确. 故选:D. 9.(25-26高二上·浙江舟山·期末)甲在一次考试中六门课程得分分别为:87,60,76,89,90,100.则此数据的极差为(  ) A.13 B.40 C.24 D.10 【答案】B 【知识点】计算几个数据的极差、方差、标准差 【分析】根据极差的定义即可求解. 【详解】由题意,甲在一次考试中六门课程得分的最大值为100,最小值为60,所以极差为. 故选:B 10.(25-26高一上·北京延庆·期末)下图的茎叶图记录了甲、乙两名学生六次数学测验的成绩(百分制).    给出下列四个结论: ①甲同学成绩的极差比乙同学成绩的极差大; ②甲同学成绩的中位数比乙同学成绩的中位数小; ③甲同学成绩的分位数比乙同学成绩的分位数小; ④甲同学成绩的方差比乙同学成绩的方差大. 其中所有正确结论的序号是(    ). A.①④ B.①③ C.②④ D.①③④ 【答案】A 【知识点】总体百分位数的估计、计算几个数据的极差、方差、标准差、由茎叶图计算中位数、计算几个数的中位数 【分析】根据极差、中位数、百分位数、方差的知识进行分析,从而确定正确答案. 【详解】甲的成绩为:61,72,89,90,93,95, 乙的成绩为:77,82,85,87,92,93, 甲的极差为,乙的极差为,故①正确; 甲的中位数为,乙的中位数为,故②错误; 甲的分位数:,取第项; 乙的分位数:,取第4项87,故③错误; 甲的平均分为, 甲的方差为, 乙的平均分为, 乙的方差为, 因,故④正确; 综上,正确结论为①④. 故选:A 1.(25-26高三上·广东深圳·月考)若一组样本数据的平均数为3,方差为2,若新增一个数据3,则新样本的方差为(    ) A.1.7 B.1.8 C.1.9 D.2 【答案】B 【知识点】计算几个数据的极差、方差、标准差 【分析】根据方差公式,代入求解,即可得答案. 【详解】由题意得, 则, 若新增一个数据3,则新样本的平均数仍为3, 则新样本的方差为 故选:B. 2.(2025·广东广州·模拟预测)某学校高三学生共有900人,其中男生500人,为获取该校高三学生的身高信息,现采用按性别比例分配的分层随机抽样的方法,抽取了容量为90的样本.计算得男生样本的身高均值为170,方差为19,女生样本的身高均值为161,方差为19,则下列说法正确的是(    ) A.抽取男生的样本量为40 B.估计该校高三学生身高的均值为165 C.抽样时女生甲被抽到的概率为 D.估计该校高三学生身高的方差为19 【答案】C 【知识点】计算几个数据的极差、方差、标准差、计算几个数的平均数、分层抽样的概率、抽样比、样本总量、各层总数、总体容量的计算 【分析】应用分层抽样判断A,应用分层抽样的均值及方差计算判断B,D,再应用分层抽样的概率计算判断C. 【详解】某学校高三学生共有900人,其中男生500人,采用按性别比例分配的分层随机抽样的方法,抽取了容量为90的样本. 则抽取男生的样本量为,A选项错误; 男生样本的身高均值为170,方差为19,女生样本的身高均值为161,方差为19, 则估计该校高三学生身高的均值为,B选项错误; 抽样时女生甲被抽到的概率为,C选项正确; 估计该校高三学生身高的方差为,D选项错误; 故选:C. 3.(2026·四川巴中·一模)水稻是世界最重要的农作物之一,也是我国60%以上人口的主粮.以袁隆平院士为首的科学家研制成功的杂交水稻制种技术在世界上被誉为中国的“第五大发明”,育种技术的突破,杂交水稻的推广,不仅让中国人端稳饭碗,也为解决世界粮食短缺问题作出了巨大贡献.某农场种植的甲、乙两种水稻在面积相等的两块稻田中连续6年的产量(单位:kg)如下: 品种 第1年 第2年 第3年 第4年 第5年 第6年 甲 900 920 900 850 910 920 乙 880 860 950 830 990 890 根据以上数据,下面说法正确的是(    ). A.甲种水稻产量的平均数比乙种水稻产量的平均数大 B.甲种水稻产量的中位数比乙种水稻产量的中位数小 C.甲种水稻产量的极差与乙种水稻产量的极差相等 D.甲种水稻的产量比乙种水稻的产量稳定 【答案】D 【知识点】用方差、标准差说明数据的波动程度、计算几个数据的极差、方差、标准差、计算几个数的平均数、计算几个数的中位数 【分析】分别计算两种水稻产量的平均数、中位数、极差、方差即可判断四个选项的正误,即可得出正确选项. 【详解】由表中数据可得, , 所以甲种水稻产量的平均数和乙种水稻产量的平均数相等,A说法错误; 甲种水稻产量的中位数为,乙种水稻产量的中位数为, 所以甲种水稻产量的中位数比乙种水稻产量的中位数大,B说法错误; 甲种水稻产量的极差为,乙种水稻产量的极差为, 所以甲种水稻产量的极差比乙种水稻产量的极差小,C说法错误, 甲种水稻产量的方差为 , 乙种水稻产量的方差为 , 甲种水稻产量的平均数和乙种水稻产量的平均数相等,甲种水稻产量的方差小于乙种水稻的产量的方差, 所以甲种水稻的产量比乙种水稻的产量稳定,D说法正确; 故选:D 4.(25-26高三上·黑龙江·月考)某中学举办迎国庆歌咏比赛,邀请了七位评委,对一个选手打分后,得到一组互不相等的数据,,,,,,,去掉其中最高分与最低分得到的数据与原始数据一定相同的是(   ) A.平均分 B.极差 C.标准差 D.中位数 【答案】D 【知识点】计算几个数据的极差、方差、标准差、计算几个数的平均数、计算几个数的中位数 【分析】根据平均数、极差、标准差、中位数的概念和运算法则,采用赋值法逐一分析判断选项正误. 【详解】选项A:若7个数据为,原平均分为, 去掉最高和最低分后平均分为, ,平均分不一定相同,故A错误; 选项B:若7个数据为,原极差为,去掉最高和最低分后极差为, ,极差不一定相同,故B错误; 选项C: 若7个数据为,则原数据平均数为, 标准差为 , 去掉最高和最低分后平均数为, 标准差为 , 标准差不一定相同,故C错误; 选项D:设,则原始数据的中位数为, ,,,,的中位数也为, 去掉其中最高分与最低分得到的数据与原始数据一定相同的是中位数,故D正确. 故选:D. 1.知识清单: (1) 离散程度指标:极差(最大值-最小值,直观但片面)、方差(平方偏差的平均数)、标准差(方差的算术平方根,与原始数据单位一致)。 (2) 核心公式: 样本方差: 样本标准差: 分层随机抽样总样本方差: (3) 统计意义:方差、标准差越大,数据离散程度越大,稳定性越差;反之则越稳定。 (4) 核心思想:用样本方差、标准差估计总体离散程度。 2.方法归纳: (1) 方差、标准差的计算步骤:先求平均数→再求偏差→平方偏差→求平均→标准差(开方)。 (2) 分层随机抽样总方差:需考虑各层方差与层间偏差的影响,采用加权计算。 (3) 实际应用:综合集中趋势(平均数、中位数)与离散程度(方差、标准差)分析数据,作出合理决策。 3.常见误区: (1) 混淆样本方差与总体方差的公式(样本方差分母为n,总体方差分母为N)。 (2) 忽略标准差与原始数据单位一致的优势,误将方差作为最终描述指标。 (3) 分层随机抽样总方差计算时,遗漏层间偏差的影响,直接将各层方差平均。 (4) 仅依据方差或平均数单一指标下结论,缺乏综合分析。 4.知识拓展: 在实际问题中,大多数数据会落在区间内,这一规律可用于数据异常值的判断。 习题9. 2(第214页)第1, 2,3题 学科网(北京)股份有限公司 学科网(北京)股份有限公司 $

资源预览图

9.2.4 总体离散程度的估计(导学案)数学人教A版必修第二册
1
9.2.4 总体离散程度的估计(导学案)数学人教A版必修第二册
2
9.2.4 总体离散程度的估计(导学案)数学人教A版必修第二册
3
所属专辑
相关资源
示范课
由于学科网是一个信息分享及获取的平台,不确保部分用户上传资料的 来源及知识产权归属。如您发现相关资料侵犯您的合法权益,请联系学科网,我们核实后将及时进行处理。