管理数量方法与分析完成版汇编.doc

  1. 1、本文档共57页,可阅读全部内容。
  2. 2、有哪些信誉好的足球投注网站(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
管理数量方法与分析完成版汇编

第1章 数据分析的基础 1.1 数据分组与变量数列 1.数据分组 数据分组就是对某一变量的不同取值,按照其自身变动特点和研究需要划分成不同的组别,以便更好地研究该变量分布特征及变动规律.由于变量有离散变量与连续变量的区别,因而对其进行分组可分为单项分组与组距分组两种不同的分组方法. 若变量是离散型变量,且取值只有不多的几个时,则采用单项分组.这种分组的做法是:将变量的不同取值作为一组的组别,变量有多少个不同取值就划分成多少组. 若变量是连续型变量,或者是取值较多的离散型变量,则需采用组距分组.这种分组的做法是:将变量的全部职值按照其大小顺序划分成若干个不同数值的区间. 2.变量数列 (1)变量数列的概念 在对变量取值进行分组的基础上,将各组不同的变量值与其变量值出现的次数排列成的数列,称为变量数列.由于对变量分组有单项分组和组距分组两种不同的方法,因而分组后所形成的变量数列也有单项数列和组距数列两种. (2)累计频数和累计频率 向上累计频数(或频率)的具体做法是;由变量值低的组向变量值高的组依次累计频数(或频率).向上累计频数的结果表明某组上限以下的各组次数(或频数)之和是多少;向上累计频率的结果表明某组上限以下的各组次数(或频数)之和占总次数(或总频数)的比重是多少. 向下累计频数(或频率)的具体做法是:由变量值高的组向变量值低的组依次累计频数(或频率).向下累计频数的结果表明某组下限及以上各组次数(或频数)之和是多少;向下累计频率的结果表明某组下限及以上各组次数(或频数)之和占总次数(或总频数)的比重. (3)变量数列分布图 常用的次数分布图主要有柱状图、直方图和折线图等几种. 1.2 分布中心的测度 1.分布中心的概念及意义 分布中心是指距离一个变量的所有取值最近的位置.揭示变量的分布中心有着十分重要的意义: (1)变量的分布中心是变量取值的一个代表,可以用来反映其取值的一般水平. (2)变量的分布中心可以揭示其取值的次数分布在直角坐标系上的集中位置,可以用来反映变量分布密度曲线的中心位置,即对称中心或尖峰位置. 2.分布中心的测度指标及其计算方法 (1)算术平均数 ① 简单算术平均数:如果所掌握的资料是未经分组整理的一组变量值,就需要采用简单算术平均的方法计算其算术平均数. 设某一变量x的不同取值为X1,X2,...Xn,则计算其算术平均数的公式为: ② 加权算术平均数:如果所掌握的资料是已经经过分组整理的变量数列资料,包括单项分组的单项数列和组距分组的组距数列.要计算其变量值的算术平均数都需要采用加权算术平均的方法. 设X1,X2,…,Xn代表各组的变量值,f1,f2,…,fn代表各组变量值出现的次数,也称权数.则加权算术平均数的计算公式为: (2)中位数 中位数是指将某一变量的变量值按照从小到太的顺序排成一列,位于这列数中心位置上的那个变量值.由于所掌握的资料不同,确定中位数的方法也有所区别: ①来分组资科中住散的确定. ②单项数列中位数的确定. ③组距数列中位数的确定. (3)众数 众数是指某一变量的全部取值中出现次数最多的那十变量值.由于掌握资料不同,众数的确定方法也有所不同若掌握某一变量的一组末分组的变量值,则只需要绕计出现次数最多的那个变量值即可;若掌握的资料是单项数列,则频数(或频率)最大组的变量值就是众数.若掌握的资料是组距数列,耍确定众数,首先依据各组变量值出现次数多少确定众数所在的组,然后采用上限公或者下限公式确定众数即可. 1.3离散程度的测度 1. 离散程度测度的意义 (1)通过对变量取值之间离散程度的测定,可以反映各个变量值之间的差异大小,从而也就可以反映分布中心指标对各个变盘值代表性的高低. (2)通过对变量取值之间离散程度的测定,可以大致反映变量次数分布密度曲线的形状. 2.离散程度的测度指标 (1)极差 极差又称全距,是指一组变量值中最大变量值与最小变量值之差,用来表示变量的变动范围.通常用R代表全距. R=max(xi)一min(xi) (2)四分位全距 四分位全距是指将一组由小到大排列的变量数列分成四等分,可得到三个分割点Ql、Q2、Q3,,分别称为第一个、第二个、第三十四分位数;然后用第一十四分位数Ql减去第三个四分位靛Q3所得差的绝对值,即为四分位全距. (3)平均差 平均差是变量各个取值偏差绝对值的算术平均数由于变量的各个取值与其算术平均数的偏差有正有负,直接相加会使其正负抵消而为O.所以可将每个偏差取绝对值后再相加求平均.如此便得到了平均差.实际上,平均差反映了变量的各个取值离其算术平均数的平均距离. (4)标准差 标准

您可能关注的文档

文档评论(0)

jiayou10 + 关注
实名认证
内容提供者

该用户很懒,什么也没介绍

版权声明书
用户编号:8133070117000003

1亿VIP精品文档

相关文档