期刊专题

10.11897/SP.J.1016.2019.01232

非平衡基因数据的差异表达基因选择算法研究

引用
针对准确率不适于评价不平衡数据特征子集性能的缺陷,提出了F2-measure(简称F2)准则.为避免mRMR(minimal Redundancy-Maximal Relevance)的互信息方法倾向于选择多值特征,提出了归一化互信息SU(Symmetrical Uncertainty).针对最大化AUC(Area Under an ROC Curve)框架下,特征选择算法的特征与类标相关性、特征间相关性的取值范围(量纲)不一致问题,提出了归一化的特征权重.为加快特征选择过程,提出了结合SU和AUC的特征预选择,缩小特征搜索空间.提出动态加权顺序前向搜索DWSFS(Dynamic Weighted Sequential Forward Search)和动态加权顺序前向浮动搜索DWSFFS(Dynamic Weighted Sequential Forward Floating Search),以期得到分类性能更好的特征子集.基于最大化AUC和mRMR框架,结合上述创新点,设计出16种特征选择算法.7个经典二类不平衡基因数据集、3个多类不平衡(或近似平衡)基因数据集的50次重复实验表明:所提算法选择的基因子集具有非常好的分类识别能力;提出的F2、SU、归一化基因权重、基因预选择,以及DWSFS和DWS-FFS对选择非平衡基因数据集的差异表达基因非常有效.提出的SU在度量基因冗余性时优于斯皮尔曼等级相关系数RCC(Rank Correlation Coefficient);基因选择过程中的权值度量采用基因与类标相关性减去基因间冗余性优于采用基因与类标相关性除以基因冗余性方案.与现有经典基因选择算法的实验比较表明:提出的基因选择算法的性能优于现有基因选择算法.

基因选择、AUC、互信息、mRMR、不平衡数据

42

TP181(自动化基础理论)

国家自然科学基金61673251;国家重点研发计划2016YFC0901900;科技成果转化培育项目GK201806013;中央高校基本科研业务费专项资金项目GK201701006;研究生培养创新基金资助项目2015CXS028,2016CSY009

2019-07-08(万方平台首次上网日期,不代表论文的发表时间)

共20页

1232-1251

暂无封面信息
查看本期封面目录

计算机学报

0254-4164

11-1826/TP

42

2019,42(6)

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn