通用集成学习算法的构造
A Universal Ensemble Learning Algorithm作者机构:中国科学院成都计算机应用研究所成都610041
出 版 物:《计算机研究与发展》 (Journal of Computer Research and Development)
年 卷 期:2013年第50卷第4期
页 面:861-872页
核心收录:
学科分类:081203[工学-计算机应用技术] 08[工学] 0835[工学-软件工程] 0812[工学-计算机科学与技术(可授工学、理学学位)]
基 金:四川省科技支撑计划基金项目(2009SZ0214 2011GZ0171)
主 题:集成学习 机器学习 AdaBoost算法 多分类问题 泛化能力
摘 要:集成学习算法的构造属于机器学习领域的重要研究内容,尽管弱学习定理指出了弱学习算法与强学习算法是等价的,但如何构造好的集成学习算法仍然是一个未得到很好解决的问题.Freund和Schapire提出的AdaBoost算法和Schapire和Singer提出的连续AdaBoost算法部分解决了该问题.提出了一种学习错误定义,以这种学习错误最小化为目标,提出了一种通用的集成学习算法,算法可以解决目前绝大多数分类需求的学习问题,如多分类、代价敏感分类、不平衡分类、多标签分类、模糊分类等问题,算法还对AdaBoost系列算法进行了统一和推广.从保证组合预测函数的泛化能力出发,提出了算法中的简单预测函数可统一基于样本的单个特征来构造.理论分析和实验结论均表明,提出的系列算法的学习错误可以任意小,同时又不用担心出现过学习现象.