第四章 平均数与变异指标 上章介绍了计数资料的整理与分析,从本章开始介绍计量资料的整理与分析。通过调查或实验收集到的计量资料,是一群大大小小的变量值。为将这群变量值的特点描述出来,当例数较多时,可先编制成频数表,了解变量值的分布情况,然后计算平均数描述其集中位置,计算变异指标描述其离散程度;若倒数较少,亦可直接计算平均数与变异指标。现分述于下。 第一节 平均数 一、频数表的编制与频数分布 计量资料有离散型变量和连续型变量。对离散型变量,可列出变量值及其频数如表4.1。若变量值较多时,亦可用组段表示如表4.2。每个组段的起点称下限,终点称上限,上限与下限之差称组距。如表4.2第一组的下限是0,上限是1。第二组的下限是2上限是3,组距都是1。归组以后,该组的变量值用组段的中值代表,称组中值。如第一组的组中值为0.5。 表4.1 某市居民1095天中每天意外死亡人数(1980~82年)
表4.2 204名轧钢工人白细胞中大单核所占百分比
若是连续型变量,组段的写法与离散型变量的略有不同。如表4.3坐高第一组段下限为61,上限为62;第二组段的下限为62,上限为63。因此,上一组段的上限和下一组段的下限值相同。为便于归组,上限一般不写出来。如第一组写成“61-”,意思是凡坐高在61至未离散型变最的数值较大时,亦可按连续型变量写组段,如红细胞数(万/mm3)的组段应写成400-419,420-439,…,亦可简化写成400-,420-,…。这样由组段和频数两部分组成的表称为频数表。下面用表4.4资料说明频数表编制步骤。?? 表4.3 某市7岁男童坐高频数表 表 4.4 西安市7岁男童102人的坐高,cm
(二)找出原始资料中的最小、最大值 表4.4坐高的最大值为71.2cm,最小值为61.1cm,最大值与最小值之差称极差为10.1cm。 (责任编辑:泉水) |