基于分类不确定性最小化的半监督集成学习算法
半监督集成是将半监督学习与集成学习相结合的一种学习范式,它一方面通过无标记样本来提高集成学习的多样性,同时解决集成学习样本量不足的问题,另一方面集成多个分类器能够进一步提升半监督学习模型的性能.现有的研究从理论和实践两个角度证明了半监督学习与集成学习之间的互益性.针对当前半监督集成学习算法对无标记样本信息利用不完全的缺陷,文中提出了一种新的基于分类不确定性最小化的半监督集成学习(Classification Uncertainty Minimization-Based Semi-Supervised Ensemble Learning,CUM-SSEL)算法,它引入信息熵作为对无标记样本进行打标的置信度评判标准,通过最小化无标记样本打标过程中的不确定性迭代地训练分类器,实现对无标记样本的高效利用,以增强分类器的泛化性能.在标准的实验数据集上对CUM-SSEL算法的可行性、合理性和有效性进行了验证,实验表明:随着基分类器的增加,CUM-SSEL算法的训练呈现收敛的趋势,同时它能够获得优于 Self-Training,Co-Training,Tri-Training,Semi-Boost,Vote-Training,Semi-Bagging 以及CST-Voting算法的分类精度.
半监督集成学习、集成学习、半监督学习、分类不确定性、置信度、信息熵
50
TP391(计算技术、计算机技术)
2023-10-13(万方平台首次上网日期,不代表论文的发表时间)
共8页
88-95