- 1、本文档共38页,可阅读全部内容。
- 2、有哪些信誉好的足球投注网站(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
聚类分析简单例子
三、类间距离的统一性 上述八种系统聚类法的步骤完全一样,只是距离的递推公式不同。兰斯(Lance)和威廉姆斯(Williams)于1967年给出了一个统一的公式。 (5.28) 其中ap、aq、 ? 、 ?是参数,不同的系统聚类法,它们取不 同的数,详见表5.8。 这里应该注意,不同的聚类方法结果不一定完全相同,一般只是大致相似。如果有很大的差异,则应该仔细考查,找到问题所在;另外,可将聚类结果与实际问题对照,看哪一个结果更符合经验。 表5.8 系统聚类法参数表 【例5.3】假定我们对A、B、C、D四个样品分别测量两个变量和得到结果见表5.9。 试将以上的样品聚成两类。 表5.9 样品测量结果 动态聚类法 第一步:按要求取K=2,为了实施均值法聚类,我们将这些样品随意分成两类,比如(A、B)和(C、D),然后计算这两个聚类的中心坐标,见表5.10所示。 表5.10中的中心坐标是通过原始数据计算得来的,比如(A、 B)类的, 等等。 表5.10 中心坐标 第二步:计算某个样品到各类中心的欧氏平方距离,然后将该样品分配给最近的一类。对于样品有变动的类,重新计算它们的中心坐标,为下一步聚类做准备。先计算A到两个类的平方距离: 由于A到(A、B)的距离小于到(C、D)的距离,因此A不用重新分配。计算B到两类的平方距离: 由于B到(A、B)的距离大于到(C、D)的距离,因此B要分配给(C、D)类,得到新的聚类是(A)和(B、C、D)。更新中心坐标如表5.11所示。 表5.11 更新后的中心坐标 第三步:再次检查每个样品,以决定是否需要重新分类。计算各样品到各中心的距离平方,得结果见表5.12。 到现在为止,每个样品都已经分配给距离中心最近的类,因此聚类过程到此结束。最终得到K=2的聚类结果是A独自成一类,B、C、D聚成一类。 表5.12 样品聚类结果 一、系统聚类的基本思想 系统聚类的基本思想是:距离相近的样品(或变量)先聚成类,距离相远的后聚成类,过程一直进行下去,每个样品(或变量)总能聚到合适的类中。系统聚类过程是:假设总共有n个样品(或变量),第一步将每个样品(或变量)独自聚成一类,共有n类;第二步根据所确定的样品(或变量)“距离”公式,把距离较近的两个样品(或变量)聚合为一类,其它的样品(或变量)仍各自聚为一类,共聚成n ?1类;第三步将“距离”最近的两个类进一步聚成一类,共聚成n ?2类;……,以上步骤一直进行下去,最后将所有的样品(或变量)全聚成一类。为了直观地反映以上的系统聚类过程,可以把整个分类系统画成一张谱系图。所以有时系统聚类也称为谱系分析。除系统聚类法外,还有有序聚类法、动态聚类法、图论聚类法、模糊聚类法等,限于篇幅,我们只介绍系统聚类方法。 二、类间距离与系统聚类法 在进行系统聚类之前,我们首先要定义类与类之间的距离,由类间距离定义的不同产生了不同的系统聚类法。常用的类间距离定义有8种之多,与之相应的系统聚类法也有8种,分别为最短距离法、最长距离法、中间距离法、重心法、类平均法、可变类平均法、可变法和离差平方和法。它们的归类步骤基本上是一致的,主要差异是类间距离的计算方法不同。以下用dij表示样品Xi与Xj之间距离,用Dij表示类Gi与Gj 之间的距离。 1. 最短距离法 定义类Gi与Gj之间的距离为两类最近样品的距离,即为 (5.11) 设Gk类与合并成一个新类记为Gr,则任一类与的距离为 (5.12) 最短距离法进行聚类分析的步骤如下: (1)定义样品之间距离,计算样品的两两距离,得一距离 阵记为D(0) ,开始每个样品自成一类,显然这时Dij = dij。 (2)找出距离最小元
您可能关注的文档
- 组合式任务驱动型作文.ppt
- 组建一个小型局域网.doc
- 练习六(一位数除三位数及验算).ppt
- 组建与维护家庭局域网.ppt
- 组态王报表()解析.ppt
- 组织行为学及其在管理中的应用.ppt
- 组织行为学精要第十版chapter10 communication.ppt
- 组织架构图、部门职责、岗位说明书.doc
- 细胞分裂识图(精).ppt
- 细胞培养基的生产和过程控制.docx
- 2025新疆大学招聘事业单位人员44人模拟试卷含答案详解.docx
- 2025学年上海大学附属嘉定实验学校教师招聘考前自测高频考点模拟试题参考答案详解.docx
- 2025山东枣庄市立医院招聘备案制人员36人考前自测高频考点模拟试题及完整答案详解1套.docx
- 2025山东宁津房开建设投资有限公司招聘工作人员拟聘用人员模拟试卷及答案详解1套.docx
- 2025山东开放大学招聘6人考前自测高频考点模拟试题附答案详解.docx
- 2025山西省气象局应届高校毕业生招聘21人模拟试卷附答案详解.docx
- 2025新疆维吾尔自治区气象局事业单位招聘应届毕业生(第三批9人)考前自测高频考点模拟试题参考答案详.docx
- 2025山西中医药大学招聘博士研究生35人考前自测高频考点模拟试题附答案详解.docx
- 2025浙江宁波杭州湾新区公用事业发展有限公司项目劳派招聘1人考前自测高频考点模拟试题含答案详解.docx
- 2025山东临沂市郯城县教育系统部分事业单位招聘教师13人模拟试卷参考答案详解.docx
最近下载
- 2024医疗质量安全管理委员会和质控小组组成和职责(红头) .pdf VIP
- T∕ZZB 0044-2016 TDR系列单晶生长炉.docx VIP
- 人工气道管理月日.ppt VIP
- 视频处理软件:Adobe Premiere Pro二次开发_(11).字幕和文本处理脚本.docx VIP
- 辽宁省实验中学、大连八中、大连二十四中、鞍山一中、东北育才学校2024届数学高一下期末达标测试试题含解析.doc VIP
- GJB438C-2024军用软件开发文档通用要求(高清,带章).pptx VIP
- xxx煤矿井下生产班班长岗位竞聘演讲稿 .doc VIP
- 大型商场照明改装实施方案.docx VIP
- 全国民用建筑工程设计技术措施 规划·建筑·景观.docx
- 数字电子技术基础 沈任元 思考题与习题.ppt
文档评论(0)