- 1、本文档共74页,可阅读全部内容。
- 2、有哪些信誉好的足球投注网站(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
第十一讲 主成分分析 一项十分著名的工作是美国的统计学家斯通(stone)在1947年关于国民经济的研究。他曾利用美国1929一1938年各年的数据,得到了17个反映国民收入与支出的变量要素,例如雇主补贴、消费资料和生产资料、纯公共支出、净增库存、股息、利息外贸平衡等等。 在进行主成分分析后,竟以97.4%的精度,用三新变量就取代了原17个变量。根据经济学知识,斯通给这三个新变量分别命名为总收入F1、总收入变化率F2和经济发展或衰退的趋势F3。更有意思的是,这三个变量其实都是可以直接测量的。斯通将他得到的主成分与实际测量的总收入I、总收入变化率?I以及时间t因素做相关分析,得到下表: 概念: 主成分分析是一种通过降维技术把多个指标约化为少数几个综合指标的综合统计分析方法,而这些综合指标能够反映原始指标的绝大部分信息,它们通常表现为原始几个指标的线性组合。 基本思想及意义 哲学理念:抓住问题的主要矛盾。 主成分分析将具有一定相关性的众多指标重新组合成新的无相互关系的综合指标来代替。通常数学上的处理就是将这P个指标进行线性组合作为新的综合指标。 问题是:这样的线性组合会很多,如何选择? 如果将选取的第一个线性组合即第一个综合指标记为F1 ,希望它能尽可能多地反映原来指标的信息,即var(F1) 越大,所包含的原指标信息就越多, F1的方差应该最大,称F1为第一主成分。 如果第一主成分F1不足以代表原来p个指标的信息,再考虑选取F2即选择第二个线性组合。为了有效地反映原来的信息, F1中已包含的信息,无须出现在F2中,即cov(F1, F2),称F2为第二主成分。 仿此可以得到p个主成分。 我们可以发现这些主成分之间互不相关且方差递减,即数据的信息包含在前若干个主成分中,因而只需挑选前几个主成分就基本上反映了原始指标的信息。这种既减少了变量的数目又抓住了主要矛盾的做法有利于问题的解决。 满足如下的条件: 如果我们将xl 轴和x2轴先平移,再同时按逆时针方向旋转?角度,得到新坐标轴Fl和F2。Fl和F2是两个新变量。 根据旋转变换的公式: 旋转变换的目的是为了使得n个样品点在Fl轴方向上的离 散程度最大,即Fl的方差最大。变量Fl代表了原始数据的绝大 部分信息,在研究某经济问题时,即使不考虑变量F2也无损大局。经过上述旋转变换原始数据的大部分信息集中到Fl轴上,对数据中包含的信息起到了浓缩作用。 Fl,F2除了可以对包含在Xl,X2中的信息起着浓缩作用之外,还具有不相关的性质,这就使得在研究复杂的问题时避免了信息重叠所带来的虚假性。二维平面上的各点的方差大部分都归结在Fl轴上,而F2轴上的方差很小。Fl和F2称为原始变量x1和x2的综合变量。F简化了系统结构,抓住了主要矛盾。 三 主成分的推导及性质 1、两个线性代数的结论 2)、若上述矩阵的特征根所对应的单位正交特征向量为 当且仅当a1 =u1时,即 时, 有最大的方差?1。因为Var(F1)=U’1?xU1=?1。 如果第一主成分的信息不够,则需要寻找第二主成分。 4、原始变量与主成分之间的相关系数 5、原始变量被主成分的提取率 前面我们讨论了主成分的贡献率和累计贡献率,他度量了F1,F2,……,Fm分别从原始变量X1,X2,……XP中提取了多少信息。那么X1,X2,……XP各有多少信息分别F1,F2,……,Fm被提取了。应该用什么指标来度量?我们考虑到当讨论F1分别与X1,X2,……XP的关系时,可以讨论F1分别与X1,X2,……XP的相关系数,但是由于相关系数有正有负,所以只有考虑相关系数的平方。 如果我们仅仅提出了m个主成分,则第i 原始变量信息的被提取率为: 定义:如果一个主成分仅仅对某一个原始变量有作用,则称为特殊成分。如果一个主成分所有的原始变量都起作用称为公共成分。 6、载荷矩阵 五 标准化变量主成分 在实际问题中,不同的变量往往有不同的量纲,由于不同的量纲会引起各变量取值的分散程度差异较大,这时,总体方差则主要受方差较大的变量的控制。 若用∑求主成分,则优先照顾了方差大的变量,有时会造成很不合理的结果。为了消除由于量纲的不同可能带来的影响,常采用变量标准化的方法,即令 这时, 定理: 其中 例题:对比标准化和非标准化数据的主成分 设 协方差矩阵和对应的相关
您可能关注的文档
- 给 水 管 道 工 程课件.ppt
- 工业大系统第三章(中南大学).pdf
- 关于联想 B490 改装系统的详细操作.doc
- 哈根达斯月饼总代理商尚品正华.xls
- 海关电子卡口系统技术方案(接华东后台).doc
- 合同工作流程.pdf
- 合信技术TP-i系列物联网触摸屏使用介绍.pdf
- 河南省中小学生学籍信息管理系统操作手册.pdf
- 极速建站代理合同[适用委托人].pdf
- 交达各代理产品批发报价20100926.xls
- 2023年度教师公开招聘通关题库附参考答案详解【黄金题型】.docx
- 2023年度教师公开招聘通关题库带答案详解(预热题).docx
- 2023年度教师公开招聘通关题库附参考答案详解【突破训练】.docx
- 2023年度教师公开招聘通关考试题库附答案详解【完整版】.docx
- 2023年度教师公开招聘通关题库推荐附答案详解.docx
- 2023年度教师公开招聘通关题库附完整答案详解(夺冠).docx
- 西师版 二年级 数学 上册 第二单元《第8课时 手指游戏》课件.pptx
- 2023年度教师公开招聘通关题库含完整答案详解(名师系列).docx
- 2023年度教师公开招聘通关题库带答案详解(B卷).docx
- 2023年度教师公开招聘通关题库【原创题】附答案详解.docx
最近下载
- 纳米陶瓷颗粒增强高铬铸铁铸渗层的组织分析.pdf VIP
- 农用植保无人机施药技术规程.doc VIP
- 税务总局电子申报软件纳税人端使用的说明书.doc VIP
- 【哔哩哔哩视频网站的财务风险识别与应对研究】8300字.docx VIP
- 成人肠内营养支持的护理.pdf VIP
- 中国热射病诊断与治疗指南(2025版).pptx VIP
- 统编版《道德与法治》四年级下册全册教案设计.docx VIP
- 区域地质调查设计编写提纲、地质图图式、区域地质调查报告编写提纲.pdf VIP
- 无钼镍高铬合金铸铁耐磨衬板的研制与应用.pdf VIP
- 一种低温脱除氢气中氧气的催化剂制备方法、催化剂及其应用.pdf VIP
文档评论(0)