AdaBoost阶段小结.pptVIP

  1. 1、本文档共31页,可阅读全部内容。
  2. 2、有哪些信誉好的足球投注网站(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  5. 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  6. 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  7. 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  8. 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
AdaBoost阶段小结整理

提纲 前期调研 AdaBoost原理 一些问题 前期调研 PAC学习模型[2-3] 机器学习中,训练样本再大也不能代表某类事物本身,所以从训练样本中学习得到“规则”不能对某类事物完全适用,总有失效的情况出现,所以机器学习的目标是概率逼近正确学习! 1984年 Valiant提出PAC(Probably Approximately Correct)学习模型文中提出强学习和弱学习两个概念。 Valiant的贡献 Valiant指出弱学习转换为强学习的可行性! 实际运用中,人们根据生产经验可以较为容易的找到弱学习方法,但是很多情况下要找到强学习方法是不容易的。有时候人们倾向于通过先找到弱学习然后把它转换为强学习的方式获取强学习方法,而Valiant证明了这种方式的可行性。 怎样实现弱学习转为强学习 核心思想:通过组合使弱学习互补。 学习是不适定问题,在有限的样本上,不同的学习方法得到不同的“规则”,并在不同的情况下失效,没有一种学习算法总是在任何领域产生最好的分类效果。 例如:学习算法A在a情况下失效,学习算法B在b情况下失效,那么在a情况下可以用B算法,在b情况下可以用A算法解决。这说明通过某种合适的方式把各种算法组合起来,可以提高准确率。 为实现弱学习互补,面临两个问题: (1)怎样获得不同的弱分类器? (2)怎样组合弱分类器? 怎样获得不同的弱分类器 使用不同的弱学习算法得到不同基学习器 参数估计、非参数估计… 使用相同的弱学习算法,但用不同的超参数 K-Mean不同的K,神经网络不同的隐含层… 相同输入对象的不同表示 不同的表示可以凸显事物不同的特征 使用不同的训练集 装袋(bagging) 提升(boosting) 怎样组合弱分类器 多专家组合 一种并行结构,所有的弱分类器都给出各自的预测结果,通过“组合器”把这些预测结果转换为最终结果。 eg.投票(voting)及其变种、混合专家模型 多级组合 一种串行结构,其中下一个分类器只在前一个分类器预测不够准(不够自信)的实例上进行训练或检测。 eg. 级联算法(cascading) 小结 通过前期调研我比较关注是boosting原理。 bagging在给定样本上随机抽取(有放回)训练子集,在每个训练子集上用不稳定的学习算法训练分类不同弱分类器。boosting在前一个弱分类器错分的实例在后续的弱分类器上得到更大的重视。从训练子集的获取方式上看: bagging靠“运气”,boosting有“依据”! 所谓不稳定学习算法是指训练集很小的变化会引起所产生的分类器变化很大,即学习算法高方差。例如,决策树。 AdaBoost原理 AdaBoost的由来 AdaBoost的核心思想 “关注”被错分的样本,“器重”性能好的弱分类器 怎么实现 (1)不同的训练集?调整样本权重 (2)“关注”?增加错分样本权重 (3)“器重”?好的分类器权重大 (4)样本权重间接影响分类器权重 AdaBoost的收敛性证明 整个证明的核心: ,不等 左边是最终强分类器的错误率 证明过程: 怎么使 尽量小 看到 是关于 的函数,要使 最小显然需要研 究 ! 在原始的AdaBoost算法中采用贪婪算法,每次的 都是最小的保 证 收敛到满意的结果。 在原始AdaBoost算法中h值域是{-1,1},问题是怎么找到最佳的 这时候 前面证明原始AdaBoost算法的收敛性,但是原始 AdaBoost的收敛速度是不是就是最好的,有没有 更快的?有,Schapire提出了Real AdaBoost收 敛更快! Real AdaBoost Algorithm 一些问题 AdaBoost泛化能力的证明 Adaboost中对h选择 接下来学习的方向 AdaBoost泛化能力的证明 目前对AdaBoost泛化能力的证明是各家各言,没有定论。 Freund的证明已经被实践推翻; Schapire的证明被人证明是有缺陷的; …… 我比较关注的是Freund和Schapire的证明,他们都用到一个概念叫VC维度。我查了很多文献,都没能理解这个概念,所以目前我对AdaBoost泛化能力的证明无能为力。 AdaBoost对h的选择 是h和alpha的二元函数,为什么考虑的时候都考虑alpha,没考虑h? 在原

文档评论(0)

chenchena + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档