《应用多元统计分析》课件yydyfx1.ppt
- 【下载声明】
1. 本站全部试题类文档,若标题没写含答案,则无答案;标题注明含答案的文档,主观题也可能无答案。请谨慎下单,一旦售出,不予退换。
2. 本站全部PPT文档均不含视频和音频,PPT中出现的音频或视频标识(或文字)仅表示流程,实际无音频或视频文件。请谨慎下单,一旦售出,不予退换。
3. 本页资料《《应用多元统计分析》课件yydyfx1.ppt》由用户(momomo)主动上传,其收益全归该用户。163文库仅提供信息存储空间,仅对该用户上传内容的表现方式做保护处理,对上传内容本身不做任何修改或编辑。 若此文所含内容侵犯了您的版权或隐私,请立即通知163文库(点击联系客服),我们立即给予删除!
4. 请根据预览情况,自愿下载本文。本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
5. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007及以上版本和PDF阅读器,压缩文件请下载最新的WinRAR软件解压。
- 配套讲稿:
如PPT文件的首页显示word图标,表示该PPT已包含配套word讲稿。双击word图标可打开word文档。
- 特殊限制:
部分文档作品中含有的国旗、国徽等图片,仅作为作品整体效果示例展示,禁止商用。设计者仅对作品中独创性部分享有著作权。
- 关 键 词:
- 应用多元统计分析 应用 多元 统计分析 课件 yydyfx1
- 资源描述:
-
1、1 应用多元统计分析应用多元统计分析 2 课课 程程 介介 绍绍 多元统计分析多元统计分析(简称多元分析简称多元分析)是统计学是统计学的一个重要分支的一个重要分支.它是应用数理统计学来研它是应用数理统计学来研究多变量究多变量(多指标多指标)问题的理论和方法问题的理论和方法;它它是一元统计学的推广和发展是一元统计学的推广和发展.多元统计分析是一门具有很强应用性多元统计分析是一门具有很强应用性的课程的课程;它在自然科学和社会科学等各个领它在自然科学和社会科学等各个领域中得到广泛的应用域中得到广泛的应用;它包括了很多非常有它包括了很多非常有用的数据处理方法用的数据处理方法.3第一章第一章 绪论绪论第
2、二章第二章 多元正态分布及参数的估计多元正态分布及参数的估计第三章第三章 多元正态总体参数的假设检验多元正态总体参数的假设检验第四章第四章 回归分析回归分析-第五章第五章 判别分析判别分析第六章第六章 聚类分析聚类分析第七章第七章 主主成成分分析分分析第八章第八章 因子分析因子分析第九章第九章 对应分析方法对应分析方法第十章第十章 典型相关分析典型相关分析第十一章第十一章 偏最小二乘回归分析偏最小二乘回归分析本课程的内容本课程的内容多变量分析(数据结构简化)多变量分析(数据结构简化)分类方法分类方法两组变量的相关分析两组变量的相关分析基础理论基础理论两组变量的相依分析两组变量的相依分析4普通高
3、等教育普通高等教育”十一五十一五”国家级教材国家级教材北京大学数学教学系列丛书北京大学数学教学系列丛书本科生本科生数学基础课教材数学基础课教材 应用多元统计分析应用多元统计分析(北京大学出版社北京大学出版社,高惠璇高惠璇,2006.10)使用的教材使用的教材51.实用多元统计分析实用多元统计分析(方开泰方开泰,1989,见参考文献见参考文献1)2.多元统计分析引论多元统计分析引论(张尧庭张尧庭,方开泰方开泰,2003,见见2)3.实用多元统计分析实用多元统计分析(王学仁王学仁,1990,见见6)4.应用多元分析应用多元分析(王学民王学民,1999,见见8)5.实用统计方法与实用统计方法与SAS
4、系统系统(高惠璇高惠璇,2001,见见3)6.多元统计分析多元统计分析(于秀林于秀林,1999,见见9)7.多元统计方法多元统计方法(周光亚周光亚,1988,见见28)8.多元分析多元分析(英英.M.肯德肯德 尔尔,1983,见见15)9.SAS系统使用手册等资料系统使用手册等资料(1994-1998,见见17-21)参考书(一)参考书(一)6 (1)An Introduction to Multivariate Statistical Analysis(Anderson 1984,见见22)参考书(二)参考书(二)(2)Applied Multivariate Statistical Ana
5、lysis(Richard A.Johnson and Dean W.Wichern 4th ed 1998)中译本:中译本:实用多元统计分析实用多元统计分析(陆璇译(陆璇译 2001,见见5)(3)Linear Statistical Inference and Its Applications (C.R.Rao 1973)中中 译译 本:线性统计推断及其应用本:线性统计推断及其应用(C.R.劳劳 1987,见见25)7 教学方式教学方式:授课与实际例题相结合授课与实际例题相结合.本课程的特点与教学方式本课程的特点与教学方式 本课程的特点本课程的特点是将常用的多元分析方法的是将常用的多元分析
6、方法的介绍与在计算机上实现这些方法的软件紧介绍与在计算机上实现这些方法的软件紧密地结合起来,不仅介绍每种多元分析方密地结合起来,不仅介绍每种多元分析方法法 的实际背景、统计思想、统计模型、数的实际背景、统计思想、统计模型、数学原理和解题的思路,并结合实例介绍应学原理和解题的思路,并结合实例介绍应用统计软件用统计软件(SAS系统系统)解决问题的步骤和计解决问题的步骤和计算结果的分析。算结果的分析。8 第一章第一章 绪绪 论论1.1 1.1 引引 言言 在实际问题中,很多随机现象涉及到在实际问题中,很多随机现象涉及到的变量不止一个,而经常是多个变量,而的变量不止一个,而经常是多个变量,而且这些变量
7、间又存在一定的联系。我们常且这些变量间又存在一定的联系。我们常常需要处理多个变量的观测数据。例如考常需要处理多个变量的观测数据。例如考察学生的学习情况时,就需了解学生在几察学生的学习情况时,就需了解学生在几个主要科目的考试成绩个主要科目的考试成绩。下表给出从中学某年级随机抽取的下表给出从中学某年级随机抽取的1212名学生中名学生中5 5门主要课程期末考试成绩。门主要课程期末考试成绩。9第一章第一章 绪绪 论论1.1 1.1 引引 言言序号序号 政治政治 语文语文 外语外语 数学数学 物理物理 1 99 94 93 100 1001 99 94 93 100 100 2 99 88 96 99
8、97 2 99 88 96 99 97 3 100 98 81 96 100 3 100 98 81 96 100 4 93 88 88 99 96 4 93 88 88 99 96 5 100 91 72 96 78 5 100 91 72 96 78 6 90 78 82 75 97 6 90 78 82 75 97 7 75 73 88 97 89 7 75 73 88 97 89 8 93 84 83 68 88 8 93 84 83 68 88 9 87 73 60 76 84 9 87 73 60 76 8410 95 82 90 62 3910 95 82 90 62 3911
9、76 72 43 67 7811 76 72 43 67 7812 85 75 50 34 3712 85 75 50 34 3710第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 上表提供的数据,如果用一元统计方法,势上表提供的数据,如果用一元统计方法,势必要把多门课程分开分析,每次分析处理一门必要把多门课程分开分析,每次分析处理一门课的成绩。这样处理,由于忽视了课程之间可课的成绩。这样处理,由于忽视了课程之间可能存在的相关性,因此,一般说来,丢失信息能存在的相关性,因此,一般说来,丢失信息太多。分析的结果不能客观全面地反映某年级太多。分
10、析的结果不能客观全面地反映某年级学生的学习情况。学生的学习情况。本课程要讨论的多元分析方法,它同时对本课程要讨论的多元分析方法,它同时对多门课程成绩进行分析。这样的分析对这些课多门课程成绩进行分析。这样的分析对这些课程之间的相互关系、相互依赖性等都能提供有程之间的相互关系、相互依赖性等都能提供有用的信息。用的信息。11第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 由于大量实际问题都涉及到多个变量,这由于大量实际问题都涉及到多个变量,这些变量又是随机变化,如学生的学习成绩随着些变量又是随机变化,如学生的学习成绩随着被抽取学生的不同成绩也有变
11、化(我们往往需被抽取学生的不同成绩也有变化(我们往往需要依据它们来推断全年级的学习情况)。所以要依据它们来推断全年级的学习情况)。所以要讨论多维随机向量的统计规律性。要讨论多维随机向量的统计规律性。多元统计分析就是讨论多维随机向多元统计分析就是讨论多维随机向量的理论和统计方法的总称。量的理论和统计方法的总称。多元统计分析多元统计分析研究研究 的对象的对象就是多就是多维随机向量维随机向量.12第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 研究的内容既包括一元统计学中某研究的内容既包括一元统计学中某些方法的直接推广,也包括多个随机些方法的直接
12、推广,也包括多个随机变量特有的一些问题。变量特有的一些问题。多元统计分析是一类范围很广多元统计分析是一类范围很广的理论和方法。的理论和方法。企图用三言两语来下一个严格的定义企图用三言两语来下一个严格的定义是困难的是困难的.13第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 就以学生成绩为例,我们可以研究很多就以学生成绩为例,我们可以研究很多问题:用各科成绩的总和作为综合指标来问题:用各科成绩的总和作为综合指标来比较学生学习成绩的好坏比较学生学习成绩的好坏(如成绩好的与成如成绩好的与成绩差的,又如文科成绩好的与理科成绩好绩差的,又如文科成绩好
13、的与理科成绩好的);研究各科成绩之间的关系(如物理的);研究各科成绩之间的关系(如物理与数学成绩的关系,文科成绩与理科成绩与数学成绩的关系,文科成绩与理科成绩的关系);的关系);等等。所有这些都属于多等等。所有这些都属于多元统计分析的研究内容。元统计分析的研究内容。14第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 综上所述,多元分析以综上所述,多元分析以个变量的个变量的n次观次观测数据组成的数据矩阵测数据组成的数据矩阵 x11 x12 x1p x21 x22 x2p .xn1 xn2 xnpX=为依据。根据实际问题的需要,给出种种方法为依
14、据。根据实际问题的需要,给出种种方法。英国著名统计学家。英国著名统计学家.肯德尔(肯德尔(M.G.KendallM.G.Kendall)在多元分析一书中把多元分析所研究的在多元分析一书中把多元分析所研究的内容和方法概括为以下几个方面内容和方法概括为以下几个方面:15第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 1.1.简化数据结构简化数据结构(降维问题降维问题)例如通过变量变换等方法使相互依赖的变量例如通过变量变换等方法使相互依赖的变量变成互不相关的;或把高维空间的数据投影到变成互不相关的;或把高维空间的数据投影到低维空间,使问题得到简化
15、而损失的信息又不低维空间,使问题得到简化而损失的信息又不太多太多.主成分分析,因子分析主成分分析,因子分析,对应分析等多元对应分析等多元统计方法就是这样的一类方法。统计方法就是这样的一类方法。.分类与判别(归类问题)分类与判别(归类问题)对所考查的对象对所考查的对象(样品点或变量)按相似程度进行样品点或变量)按相似程度进行分类(或归类)。聚类分析和判别分析等方法是解分类(或归类)。聚类分析和判别分析等方法是解决这类问题的统计方法决这类问题的统计方法。16第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 3.3.变量间的相互联系变量间的相互联系
16、(1)(1)相互依赖关系相互依赖关系:分析一个或几个变量的变分析一个或几个变量的变化是否依赖于另一些变量的变化化是否依赖于另一些变量的变化?如果是如果是,建立建立变量间的定量关系式变量间的定量关系式,并用于预测或控制并用于预测或控制-回回归分析归分析.(2)(2)变量间的相互关系变量间的相互关系:分析两组变量间的相分析两组变量间的相互关系互关系-典型相关分析等典型相关分析等.(3 3)两组变量间的相互依赖关系)两组变量间的相互依赖关系-偏最小二偏最小二乘回归分析乘回归分析.17 第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的研究多元分析的研究 对象和内容对象和内容 5.5.多元统
17、计分析的理论基础多元统计分析的理论基础 包括多维随机向量及多维正态随机向量,及由此定包括多维随机向量及多维正态随机向量,及由此定义的各种多元统计量,推导它们的分布并研究其性质义的各种多元统计量,推导它们的分布并研究其性质,研究它们的抽样分布理论。这些不仅是统计估计和,研究它们的抽样分布理论。这些不仅是统计估计和假设检验的基础,也是多元统计分析的理论基础。假设检验的基础,也是多元统计分析的理论基础。.多元数据的统计推断多元数据的统计推断 参数估计和假设检验问题参数估计和假设检验问题.特别是多元正态分特别是多元正态分布的均值向量和协差阵的估计和假设检验等问布的均值向量和协差阵的估计和假设检验等问题
18、。题。18第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的发展历史多元分析的发展历史 多元统计分析起源于二十世纪初,多元统计分析起源于二十世纪初,19281928年年WishartWishart发表论文多元正态总体样本协方差发表论文多元正态总体样本协方差阵的精确分布阵的精确分布,可以说是多元分析的开端可以说是多元分析的开端.之之后后R.A.FisherR.A.Fisher、H.HotellingH.Hotelling、S.N.RoyS.N.Roy、许宝许宝录等人作了一系列奠基的工作,使多元统计分录等人作了一系列奠基的工作,使多元统计分析在理论上得到迅速的发展析在理论上得到迅速的发展
19、,在许多领域中也在许多领域中也有了实际应用有了实际应用.由于用统计方法解决实际问题由于用统计方法解决实际问题时需要的计算量很大,使其发展受到影响时需要的计算量很大,使其发展受到影响,甚甚至停滞了相当长的时间至停滞了相当长的时间.19第一章第一章 绪绪 论论1.1 1.1 引言引言-多元分析的的发展历史多元分析的的发展历史 二十世纪二十世纪5050年代中期年代中期,随着电子计算机的出随着电子计算机的出现和发展现和发展,使得多元统计分析在地质、气象、医使得多元统计分析在地质、气象、医学、社会学等方面得到广泛的应用学、社会学等方面得到广泛的应用.60.60年代通过年代通过应用和实践又完善和发展了理论
20、应用和实践又完善和发展了理论,由于新理论、由于新理论、新方法的不断出现又促使它的应用范围更加扩新方法的不断出现又促使它的应用范围更加扩大大.多元统计的方法在我国至多元统计的方法在我国至7070年代初期才受到年代初期才受到各个领域的极大关注各个领域的极大关注,近近3030多年来我国在多元统多年来我国在多元统计方法的理论研究和应用上也取得了很多显著计方法的理论研究和应用上也取得了很多显著成绩成绩,有些研究工作已达到国际水平有些研究工作已达到国际水平,并已形成并已形成一支科技队伍一支科技队伍,活跃在各条战线上活跃在各条战线上.20第一章第一章 绪绪 论论1.21.2 多元统计分析的应用领域多元统计分
21、析的应用领域-教育学教育学 多元统计分析是解决实际问题有效的数据处理方多元统计分析是解决实际问题有效的数据处理方法。随着电子计算机使用的日益普及,多元统计方法法。随着电子计算机使用的日益普及,多元统计方法已广泛地应用于自然科学,社会科学的各个方面。以已广泛地应用于自然科学,社会科学的各个方面。以下我们列举多元分析的一些应用领域。从中可看到多下我们列举多元分析的一些应用领域。从中可看到多元分析应用的广度和深度。元分析应用的广度和深度。1.1.教育学教育学 n个考生报考北大概率统计系个考生报考北大概率统计系.每个考生参加每个考生参加7 7门课门课(语文、语文、数学、政治、外语、物理、化学、生物)的
22、考试,各门课成绩数学、政治、外语、物理、化学、生物)的考试,各门课成绩记为记为Yj1,Yj2,Yj7 。又每个考生在高中学习期间,又每个考生在高中学习期间,m门主要课门主要课程成绩为程成绩为Xj1,Xj2,Xjm(j=1,2,=1,2,n)。经对这大量的资经对这大量的资料作统计分析,我们能够得出:料作统计分析,我们能够得出:21第一章第一章 绪绪 论论1.2 1.2 多元统计分析的应用领域多元统计分析的应用领域-教育学教育学 (1)(1)高考成绩和高中学习期间成绩的关系高考成绩和高中学习期间成绩的关系,即给出两即给出两组变量线性组合间的关系组变量线性组合间的关系,从而可由考生在高中期间的从而可
23、由考生在高中期间的学习成绩来预报高考的综合成绩或某科目的成绩学习成绩来预报高考的综合成绩或某科目的成绩.(2)(2)给出考生成绩次序排队的最佳方案给出考生成绩次序排队的最佳方案(最佳最佳组合组合).).总分可以体现一个考生成绩好坏总分可以体现一个考生成绩好坏,但对报但对报考概率统计系的学生考概率统计系的学生,按总分从高到低的顺序录按总分从高到低的顺序录取并不是最合适的取并不是最合适的.应按适当的权数加权求和应按适当的权数加权求和.如如数学、物理、外语的权数相对高些数学、物理、外语的权数相对高些.22第一章第一章 绪绪 论论1.2 1.2 多元统计分析的应用领域多元统计分析的应用领域-教育学教育
24、学 (3)(3)利用利用n个学生在高中学习期间个学生在高中学习期间m门主科门主科的考试成绩,可对学生进行分类,如按文、理的考试成绩,可对学生进行分类,如按文、理科成绩分类,按总成绩分类等。若准备给优秀科成绩分类,按总成绩分类等。若准备给优秀学生发奖,那么一等奖、二等奖的比例应该是学生发奖,那么一等奖、二等奖的比例应该是多少?应用多元统计分析的方法可以给出公平多少?应用多元统计分析的方法可以给出公平合理地确定。合理地确定。23教育学教育学-主成分分析在学生学习成绩排序中的应用主成分分析在学生学习成绩排序中的应用 我我在担任学生班主任期间在担任学生班主任期间,经常会遇到学经常会遇到学校下达的评选三
25、好生校下达的评选三好生,评选学习奖等任务评选学习奖等任务.另另还有评选各种奖学金的工作还有评选各种奖学金的工作;推荐研究生的推荐研究生的工作都要求班主任提出意见工作都要求班主任提出意见.如何利用全班学生在校几年中主要课程如何利用全班学生在校几年中主要课程的学习成绩及各方面的表现更科学的学习成绩及各方面的表现更科学,更合理更合理地进行评选地进行评选?应用多元统计分析中的主成分应用多元统计分析中的主成分方法可以给出公平合理地确定方法可以给出公平合理地确定.24教育学教育学-主成分分析在学生学习成绩排序中的应用主成分分析在学生学习成绩排序中的应用 比如全班有比如全班有4040名学生名学生,本科生四年
展开阅读全文