《应用统计学》(02)第2章用图表和统计量看数据

整理文档很辛苦,赏杯茶钱您下走!

免费阅读已结束,点击下载阅读编辑剩下 ...

阅读已结束,您可以下载文档离线阅读编辑

资源描述

应用统计学AppliedStatistics2-12019-9-20应用统计学AppliedStatistics应用统计学AppliedStatistics2-22019-9-20图并没有说谎,是说谎者在画图。BenjaminDisraeli统计名言应用统计学AppliedStatistics2-32019-9-20怎样解决下面的问题?当你获得了一个地区各年的GDP(国内生产总值)数据如何观察经济的走势?当你有一个班级学生考试分数的数据,如何知道全班学生的学习状况?当你有一个企业职工工资的数据,该怎样处理和分析它们?你要用这些数据做什么?你关心这些数据的那些特征?应用统计学AppliedStatistics2-42019-9-20统计应用一种测量的平均数比单个的测量更可靠即使用一种很准确、很可靠的仪器对同一物体进行重复测量,由于一些无法控制的因素的影响,每次得到的结果也不见得一样(美国)国家标准与技术协会(NIST—NationalInstituteofStandardsandTechnology)的原子钟非常准确,它的准确程度是每600万年误差1秒,但也并不是百分之百准确世界标准时间是世界协调时间(UniversalCoordinatedTime),它是由位于法国的塞夫尔的国际计量局(BIPM)所“编辑”的。BIPM并没有比NIST更好的钟,它给出的时间是根据世界各地200个原子钟的平均时间得来的应用统计学AppliedStatistics2-52019-9-20统计应用把数据画图之后,要用用脑袋沃德(AbrahamWald)和许多统计学家一样,在第二次世界大战时也处理了战争与相关的问题。他发明的一些统计方法在战时被视为军事机密。以下是他提出的概念中较简单的一种沃德被咨询飞机上什么部位应该加强钢板时,开始研究从战役中返航的军机上受敌军创伤的弹孔位置。他画了飞机的轮廓,并且标识出弹孔的位置。资料累积一段时间后,几乎把机身各部位都填满了。于是沃德建议,把剩下少数几个没有弹孔的部位补强。因为这些部位被击中的飞机都没有返航资料来源:DavidS.Mroore著《统计学世界》第2章用图表和统计量看数据2.1用图表描述数据2.2用统计量描述数据2.1用图表描述数据2.1.1用图表展示定性数据2.1.2用图表展示定量数据第2章用图表和统计量看数据2.1.1用图表展示定性数据2.1用图表描述数据应用统计学AppliedStatistics2-92019-9-20用Excel生成频数分布表(例题分析)【例】一家市场调查公司为研究不同类型饮料的市场占有率,对随机抽取的一家超市进行调查。调查员在某天对50名顾客购买饮料的类型进行了记录,如果一个顾客购买某一类型的饮料,就将这一类型的饮料记录一次。右边就是记录的原始数据用Excel制作频数分布表绿色健康饮品应用统计学AppliedStatistics2-102019-9-20使用Excel数据透视表数计数(pivottable)第1步:选择【数据】菜单中的【数据透视表和数据透视图】第2步:确定数据源区域第3步:在【向导—3步骤之3】中选择数据透视表的输出位置。然后选择【布局】第4步:在【向导—布局】对话框中,依次将“分类变量“(这是饮料品牌)连续拖放两次:一次拖至左边的“行”区域,一次拖至“数据”区域第5步:然后单击【确定】,自动返回【向导—3步骤之3】对话框。然后单击【完成】,即可输出数据透视表用数据透视表产生分类数据的频数分布应用统计学AppliedStatistics2-112019-9-20使用Excel计数函数(COUNTIF)如果只需要计算某一类别的数据个数,可以使用Excel中的统计函数【COUNTIF】。在对话框【Range】后输入数据区域,在【Criteria】后输入数字、表达式、字符串等,计数单元格必须符合的条件,即可得出结果例如,我们要计算出碳酸饮料出现的频数,在【Rang】后输入数据所在的区域,在【Criteria】后输入“碳酸饮料”,结果为15。如果数据区域是数值型数据,计算符合特定条件的数据个数,则可在【Criteria】后输入“某一数值”、“某一数值”、“=某一数值”,等等统计函数—COUNTIF应用统计学AppliedStatistics2-122019-9-20定性数据的图示—条形图(例题分析)610151180481216果汁矿泉水碳酸饮料绿茶其他饮料类型频数应用统计学AppliedStatistics2-132019-9-20定性数据的图示—条形图(barChart)1.用宽度相同的条形的高度或长短来表示各类别数据的图形2.有单式条形图、复式条形图等形式3.主要用于反映分类数据的频数分布4.绘制时,各类别可以放在纵轴,称为条形图,也可以放在横轴,称为柱形图(columnchart)应用统计学AppliedStatistics2-142019-9-20定性数据的图示—饼图(pieChart)1.也称圆形图,是用圆形及圆内扇形的角度来表示数值大小的图形2.主要用于表示样本或总体中各组成部分所占的比例,用于研究结构性问题3.绘制圆形图时,样本或总体中各部分所占的百分比用圆内的各个扇形角度表示,这些扇形的中心角度,按各部分数据百分比乘以3600确定应用统计学AppliedStatistics2-152019-9-20定性数据的图示—饼图(例题分析)果汁12%其他16%矿泉水20%绿茶22%碳酸饮料30%应用统计学AppliedStatistics2-162019-9-20定性数据的图示—环形图(doughnutchart)1.环形图中间有一个“空洞”,样本或总体中的每一部分数据用环中的一段表示2.与饼图类似,但又有区别饼图只能显示一个总体各部分所占的比例环形图则可以同时绘制多个样本或总体的数据系列,每一个样本或总体的数据系列为一个环3.用于结构比较研究应用统计学AppliedStatistics2-172019-9-20定性数据的图示—环形图(例题分析)【例】在一项城市住房问题的研究中,研究人员在甲乙两个城市各抽样调查300户,其中的一个问题是:“您对您家庭目前的住房状况是否满意?”1.非常不满意;2.不满意;3.一般;4.满意;5.非常满意。应用统计学AppliedStatistics2-182019-9-20定性数据的图示—环形图(例题分析)8%36%31%15%7%33%26%21%13%10%非常不满意不满意一般满意非常满意甲乙两城市家庭对住房状况的评价2.1.2用图表展示定量数据2.1用图表描述数据应用统计学AppliedStatistics2-202019-9-20生成频数分布表(分组)1.确定组数:组数的确定应以能够显示数据的分布特征和规律为目的。在实际分组时,组数一般为5K152.确定组距:组距(ClassWidth)是一个组的上限与下限之差,可根据全部数据的最大值和最小值及所分的组数来确定,即组距=(最大值-最小值)÷组数3.统计出各组的频数~~~~~应用统计学AppliedStatistics2-212019-9-20生成频数分布表(例题分析)【例】某电脑公司2008年前4个月每天的销售额数据。用Excel生成频数分布表用Excel制作频数分布表应用统计学AppliedStatistics2-222019-9-20使用Excel频数函数(FREQUENCY)Excel的【直方图】工具的缺陷是:频数分布及直方图没有与数据链接,当改变任何一个数据时,频数分布表和直方图不会跟着改变使用统计函数【FREQUENCY】创建频数分布表和直方图可解决这一问题。具体步骤是选择与接受区域相临近的单元格区域,作为频数分布表输出的区域选择统计函数中的【FREQUENCY】函数在对话框【Date-array】后输入数据区域,在【Bins-array】后输入接受区域同时按下“ctrl-shift-Enter”组合键,即得到频数分布统计函数—FREQUENCY应用统计学AppliedStatistics2-232019-9-20分组数据—直方图(histogram)1.用于展示分组数据分布的一种图形2.用矩形的宽度和高度来表示频数分布本质上是用矩形的面积来表示频数分布3.在直角坐标中,用横轴表示数据分组,纵轴表示频数或频率,各组与相应的频数就形成了一个矩形,即直方图4.直方图下的总面积等于1用Excel制作直方图应用统计学AppliedStatistics2-242019-9-20用SPSS绘制直方图第1步:选择【Graphs】下拉菜单,并选择【histogram】选项进入主对话框第2步:在主对话框中将变量选入【Variables】,点击【OK】用SPSS绘制直方图应用统计学AppliedStatistics2-252019-9-20分组数据—直方图(SPSS绘制的直方图)应用统计学AppliedStatistics2-262019-9-20分组数据—直方图(直方图与条形图的区别)1.条形图是用条形的长度(横置时)表示各类别频数的多少,其宽度(表示类别)则是固定的2.直方图是用面积表示各组频数的多少,矩形的高度表示每一组的频数或百分比,宽度则表示各组的组距,其高度与宽度均有意义3.直方图的各矩形通常是连续排列,条形图则是分开排列4.条形图主要用于展示分类数据,直方图则主要用于展示数值型数据应用统计学AppliedStatistics2-272019-9-20原始数据—茎叶图(stem-and-leafdisplay)1.用于显示未分组的原始数据的分布2.由“茎”和“叶”两部分构成,其图形是由数字组成的3.以该组数据的高位数值作树茎,低位数字作树叶4.树叶上只保留最后一位数字5.茎叶图类似于横置的直方图,但又有区别直方图可观察一组数据的分布状况,但没有给出具体的数值茎叶图既能给出数据的分布状况,又能给出每一个原始数值,保留了原始数据的信息直方图适用于大批量数据,茎叶图适用于小批量数据应用统计学AppliedStatistics2-282019-9-20用SPSS绘制茎叶图和箱线图(包括直方图)第1步:选择【Analyze】下拉菜单,并选择【Descriptivestatistics-Explore】选项进入主对话框第2步:在主对话框中将变量选入【Variables】,点击【Plots】,在对话框中选择【Stem-and-leaf】(根据需要可选【Histogram】以给出直方图)。点击【Continue】回到主对话框。点击【OK】用SPSS绘制茎叶图应用统计学AppliedStatistics2-292019-9-20原始数据—茎叶图(例题分析)某电脑公司销售额分布的茎叶图应用统计学AppliedStatistics2-302019-9-20原始数据—箱线图(boxplot)1.用于显示未分组的原始数据的分布2.由一组数据的5个特征值绘制而成,它由一个箱子和两条线段组成3.绘制方法首先找出一组数据的5个特征值,即最大值、最小值、中位数Me和两个四分位数(下四分位数QL和上四分位数QU)连接两个四分位数画出箱子,再将两个极值点与箱子相连接该箱线图也称为Median/Quart./Range箱线图应用统计学AppliedStatistics2-312019-9-20原始数据—简单箱线图(箱线图的构成)中位数4681012QUQLX最大值X最小值Median/Quart./Range箱线图应用统计学AppliedStatistics2-322019-9-20原始数据—简单箱线图(例题分析)最小值141最大值237中位数182下四分位数170.25上四分位数197140150160170180190200210220230240某电脑公司销售额数据的Median/Quart./Rang箱线图应用统计学AppliedStatistics2-332019-9-20分布的形状与箱线图

1 / 87
下载文档,编辑使用

©2015-2020 m.777doc.com 三七文档.

备案号:鲁ICP备2024069028号-1 客服联系 QQ:2149211541

×
保存成功