题文
答案
据专家权威分析,试题“为了解某住宅区的家庭用水量情况,从该住宅区中随机抽样调查了50..”主要考查你对 直方图,中位数和众数,极差,折线图,用样本估算总体 等考点的理解。关于这些考点的“档案”如下:
直方图中位数和众数极差折线图用样本估算总体
考点名称:直方图
频数分布直方图的特点:①能够显示各组频数分布的情况;②易于显示各组之间频数的差别。
作直方图的目的有:作直方图的目的就是通过观察图的形状,判断生产过程是否稳定,预测生产过程的质量。1判断一批已加工完毕的产品;搜集有关数据。直方图将数据根据差异进行分类,特点是明察秋毫地掌握差异。2在公路工程质量管理中,作直方图的目的有:①估算可能出现的不合格率;②考察工序能力估算法③判断质量分布状态;④判断施工能力;
制作频数分布直方图的方法:①集中和记录数据,求出其最大值和最小值。数据的数量应在100个以上,在数量不多的情况下,至少也应在50个以上。 我们把分成组的个数称为组数,每一个组的两个端点的差称为组距。②将数据分成若干组,并做好记号。分组的数量在5-12之间较为适宜。③计算组距的宽度。用最大值和最小值之差去除组数,求出组距的宽度。④计算各组的界限位。各组的界限位可以从第一组开始依次计算,第一组的下界为最小值减去最小测定单位的一半,第一组的上界为其下界值加上组距。第二组的下界限位为第一组的上界限值,第二组的下界限值加上组距,就是第二组的上界限位,依此类推。⑤统计各组数据出现频数,作频数分布表。⑥作直方图。以组距为底长,以频数为高,作各组的矩形图。
应用步骤:(1)收集数据。作直方图的数据一般应大于50个。(2)确定数据的极差(R)。用数据的最大值减去最小值 求得。(3)确定组距(h)。先确定直方图的组数,然后以此组数去除极差,可得直方图每组的宽度,即组距。组数的确定要适当。组数太少,会引起较大计算误差;组数太多,会影响数据分组规律的明显性,且计算工作量加大。(4)确定各组的界限值。为避免出现数据值与组界限值重合而造成频数据计算困难,组的界限值单位应取最小测量单位的1/2。分组时应把数据表中最大值和最小值包括在内。第一组下限值为:最小值-0.5;第一组上限值为:第一组下限值加组距;第二组下限值就是第一组的上限值;第二组上限值就是第二组的下限值加组距;第三组以后,依此类推定出各组的组界。(5)编制频数分布表。把多个组上下界限值分别填入频数分布表内,并把数据表中的各个数据列入相应的组,统计各组频数据(f )。(6)按数据值比例画出横坐标。(7)按频数值比例画纵坐标。以观测值数目或百分数表示。(8)画直方图。按纵坐标画出每个长方形的高度,它代表取落在此长方形中的数据数。(注意:每个长方形的宽度都是相等的。)在直方图上应标注出公差范围(T)、样本容量(n)、样本平均值(x)、样本标准偏差值(s)和x的位置等。
考点名称:中位数和众数
平均数、中位数和众数异同:一、相同点平均数、中位数和众数这三个统计量的相同之处主要表现在:都是来描述数据集中趋势的统计量;都可用来反映数据的一般水平;都可用来作为一组数据的代表。二、不同点它们之间的区别,主要表现在以下方面。1、定义不同平均数:一组数据的总和除以这组数据个数所得到的商叫这组数据的平均数。中位数:将一组数据按大小顺序排列,处在最中间位置的一个数叫做这组数据的中位数 。众数:在一组数据中出现次数最多的数叫做这组数据的众数。2、求法不同平均数:用所有数据相加的总和除以数据的个数,需要计算才得求出。中位数:将数据按照从小到大或从大到小的顺序排列,如果数据个数是奇数,则处于最中间位置的数就是这组数据的中位数;如果数据的个数是偶数,则中间两个数据的平均数是这组数据的中位数。它的求出不需或只需简单的计算。众数:一组数据中出现次数最多的那个数,不必计算就可求出。3、个数不同在一组数据中,平均数和中位数都具有惟一性,但众数有时不具有惟一性。在一组数据中,可能不止一个众数,也可能没有众数。4、呈现不同平均数:是一个“虚拟”的数,是通过计算得到的,它不是数据中的原始数据。中位数:是一个不完全“虚拟”的数。当一组数据有奇数个时,它就是该组数据排序后最中间的那个数据,是这组数据中真实存在的一个数据;但在数据个数为偶数的情况下,中位数是最中间两个数据的平均数,它不一定与这组数据中的某个数据相等,此时的中位数就是一个虚拟的数。众 数:是一组数据中的原数据 ,它是真实存在的。5、代表不同平均数:反映了一组数据的平均大小,常用来一代表数据的总体 “平均水平”。中位数:像一条分界线,将数据分成前半部分和后半部分,因此用来代表一组数据的“中等水平”。众数:反映了出现次数最多的数据,用来代表一组数据的“多数水平”。这三个统计量虽反映有所不同,但都可表示数据的集中趋势,都可作为数据一般水平的代表。6、特点不同平均数:与每一个数据都有关,其中任何数据的变动都会相应引起平均数的变动。主要缺点是易受极端值的影响,这里的极端值是指偏大或偏小数,当出现偏大数时,平均数将会被抬高,当出现偏小数时,平均数会降低。中位数:与数据的排列位置有关,某些数据的变动对它没有影响;它是一组数据中间位置上的代表值,不受数据极端值的影响。众数:与数据出现的次数有关,着眼于对各数据出现的频率的考察,其大小只与这组数据中的部分数据有关,不受极端值的影响,其缺点是具有不惟一性,一组数据中可能会有一个众数,也可能会有多个或没有 。7、作用不同平均数:是统计中最常用的数据代表值,比较可靠和稳定,因为它与每一个数据都有关,反映出来的信息最充分。平均数既可以描述一组数据本身的整体平均情况,也可以用来作为不同组数据比较的一个标准。因此,它在生活中应用最广泛,比如我们经常所说的平均成绩、平均身高、平均体重等。中位数:作为一组数据的代表,可靠性比较差,因为它只利用了部分数据。但当一组数据的个别数据偏大或偏小时,用中位数来描述该组数据的集中趋势就比较合适。众数:作为一组数据的代表,可靠性也比较差,因为它也只利用了部分数据。。在一组数据中,如果个别数据有很大的变动,且某个数据出现的次数最多,此时用该数据(即众数)表示这组数据的“集中趋势”就比较适合。
考点名称:极差
极差:全距,又称极差,是用来表示统计资料中的变异量数,其最大值与最小值之间的差距;即最大值减最小值后所得之数据。极差是指总体各单位的标志值中,最大标志值与最小标志值之差。它是标志值变动的最大范围。极差也称为全距或范围误差,它是测定标志变动的最简单的指标。换句话说,也就是指一组数据中的最大数据与最小数据的差叫做这组数据的极差。 极差英文为range ,简写为R,表示为:R=Xmax-Xmin。移动极差(Moving Range)是其中的一种。
极差特点:刻画数据离散程度的最简单的统计量;计算简单;不能反映中间数据的分散状况。
极差用途:在统计中常用极差来刻画一组数据的离散程度,以及反映的是变量分布的变异范围和离散幅度,在总体中任何两个单位的标准值之差都不能超过极差。同时,它能体现一组数据波动的范围。极差越大,离散程度越大,反之,离散程度越小。极差只指明了测定值的最大离散范围,而未能利用全部测量值的信息,不能细致地反映测量值彼此相符合的程度,极差是总体标准偏差的有偏估计值,当乘以校正系数之后,可以作为总体标准偏差的无偏估计值,它的优点是计算简单,含义直观,运用方便,故在数据统计处理中仍有着相当广泛的应用。 但是,它仅仅取决于两个极端值的水平,不能反映其间的变量分布情况,同时易受极端值的影响。
考点名称:折线图
考点名称:用样本估算总体