- 1、本文档共42页,可阅读全部内容。
- 2、有哪些信誉好的足球投注网站(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
专题28统计案例和回归方程
【考点预测】
知识点一、变量间的相关关系
1、变量之间的相关关系
当自变量取值一定时,因变量的取值带有一定的随机性,则这两个变量之间的关系叫相关关系.由于相关关系的不确定性,在寻找变量之间相关关系的过程中,统计发挥着非常重要的作用.我们可以通过收集大量的数据,在对数据进行统计分析的基础上,发现其中的规律,对它们的关系作出判断.
注意:相关关系与函数关系是不同的,相关关系是一种非确定的关系,函数关系是一种确定的关系,而且函数关系是一种因果关系,但相关关系不一定是因果关系,也可能是伴随关系.
2、散点图
将样本中的个数据点描在平面直角坐标系中,所得图形叫做散点图.根据散点图中点的分布可以直观地判断两个变量之间的关系.
(1)如果散点图中的点散布在从左下角到右上角的区域内,对于两个变量的这种相关关系,我们将它称为正相关,如图(1)所示;
(2)如果散点图中的点散布在从左上角到右下角的区域内,对于两个变量的这种相关关系,我们将它称为负相关,如图(2)所示.
3、相关系数
若相应于变量的取值,变量的观测值为,则变量与的相关系数,通常用来衡量与之间的线性关系的强弱,的范围为.
(1)当时,表示两个变量正相关;当时,表示两个变量负相关.
(2)越接近,表示两个变量的线性相关性越强;越接近,表示两个变量间几乎不存在线性相关关系.当时,所有数据点都在一条直线上.
(3)通常当时,认为两个变量具有很强的线性相关关系.
知识点二、线性回归
1、线性回归
线性回归是研究不具备确定的函数关系的两个变量之间的关系(相关关系)的方法.
对于一组具有线性相关关系的数据(x1,y1),(x2,y2),…,(xn,yn),其回归方程的求法为
其中,,,(,)称为样本点的中心.
2、残差分析
对于预报变量,通过观测得到的数据称为观测值,通过回归方程得到的称为预测值,观测值减去预测值等于残差,称为相应于点的残差,即有.残差是随机误差的估计结果,通过对残差的分析可以判断模型刻画数据的效果以及判断原始数据中是否存在可疑数据等,这方面工作称为残差分析.
(1)残差图
通过残差分析,残差点比较均匀地落在水平的带状区域中,说明选用的模型比较合适,其中这样的带状区域的宽度越窄,说明模型拟合精确度越高;反之,不合适.
(2)通过残差平方和分析,如果残差平方和越小,则说明选用的模型的拟合效果越好;反之,不合适.
(3)相关指数
用相关指数来刻画回归的效果,其计算公式是:.
越接近于,说明残差的平方和越小,也表示回归的效果越好.
知识点三、独立性检验
1、分类变量和列联表
(1)分类变量:
变量的不同“值”表示个体所属的不同类别,像这样的变量称为分类变量.
(2)列联表:
①定义:列出的两个分类变量的频数表称为列联表.
②2×2列联表.
一般地,假设有两个分类变量X和Y,它们的取值分别为{x1,x2}和{y1,y2},其样本频数列联表(称为2×2列联表)为
总计
总计
从列表中,依据与的值可直观得出结论:两个变量是否有关系.
2、等高条形图
(1)等高条形图和表格相比,更能直观地反映出两个分类变量间是否相互影响,常用等高条形图表示列联表数据的频率特征.
(2)观察等高条形图发现与相差很大,就判断两个分类变量之间有关系.
3、独立性检验
(1)定义:利用独立性假设、随机变量来确定是否有一定把握认为“两个分类变量有关系”的方法称为两个分类变量的独立性检验.
(2)公式:,其中为样本容量.
(3)独立性检验的具体步骤如下:
①计算随机变量的观测值,查下表确定临界值:
0.5
0.40
0.25
0.15
0.10
0.05
0.025
0.010
0.005
0.001
0.455
0.708
1.323
2.072
2.706
3.841
5.024
6.635
7.879
10.828
②如果,就推断“与有关系”,这种推断犯错误的概率不超过;否则,就认为在犯错误的概率不超过的前提下不能推断“与有关系”.
(2)两个分类变量和是否有关系的判断标准:
统计学研究表明:
当时,认为与无关;
当时,有的把握说与有关;
当时,有的把握说与有关;
当时,有的把握说与有关.
【典型例题】
例1.(山东省枣庄市2024届高三学期3月模拟考试数学试题)某儿童医院用甲、乙两种疗法治疗小儿消化不良.采用有放回简单随机抽样的方法对治疗情况进行检查,得到两种疗法治疗数据的列联表:
疗法
疗效
合计
未治愈
治愈
甲
15
52
67
乙
6
63
69
合计
21
115
136
经计算得到,根据小概率值的独立性检验(已知独立性检验中),则可以认为(???)
A.两种疗法的效果存在差异
B.两种疗法的效果存在差异,这种判断犯错误的概率不超过0.005
C.两种疗法的效果没有差
您可能关注的文档
- 2025年新高考艺术生数学突破讲义 专题41 数列求和 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题01 集合 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题02 常用逻辑用语 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题03 等式与不等式的性质 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题04 基本不等式及其应用 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题05 一元二次不等式与其他常见不等式的解法 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题06 函数的概念 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题07 函数的性质-单调性、奇偶性、周期性 含解析 .docx
- 2025年新高考艺术生数学突破讲义 专题08 幂函数与二次函数 含解析.docx
- 2025年新高考艺术生数学突破讲义 专题09 指数与指数函数 含解析 .docx
- 农村寄宿制学校制度设计存在的问题及对策.docx
- 学校师资队伍建设工作总结8.docx
- 政治学调研报告选题有哪些.docx
- 2024年交通管理用金属标志及类似设施项目资金筹措计划书代可行性研究报告.docx
- 2024年洁厕剂项目资金筹措计划书代可行性研究报告.docx
- 2024年3D眼镜项目资金筹措计划书代可行性研究报告.docx
- 2024年飞机及配件项目项目投资申请报告代可行性研究报告.docx
- 2024年烃类项目项目投资申请报告代可行性研究报告.docx
- 2024年航天器电源系统项目资金筹措计划书代可行性研究报告.docx
- 2024年监控摄像头项目项目投资申请报告代可行性研究报告.docx
最近下载
- 2025年南京科技职业学院高职单招职业适应性测试近5年常考版参考题库含答案解析.docx
- 房屋建造过程介绍.pptx VIP
- 2024年互联网营销师(视频创推员)职业技能竞赛考试题库(含答案).docx VIP
- 皇汉医学丛书10选针三要集.pdf
- GBT27922—2011.doc
- 车位所有权人许可建设充电桩证明.pdf
- 条件状语从句.pdf VIP
- GZ-2021040云计算赛项正式赛卷(完整版包括试题、答案、评分标准以及全部附件)-2021年全国职业院校技能大赛赛项正式赛卷 .pdf
- TDA标准学术能力诊断测试2024年12月测试数学试题及答案.pdf
- 民族传统文化在德育中的融入研究教学研究课题报告.docx
文档评论(0)