期刊专题

10.3760/cma.j.cn112141-20210518-00272

基于随机森林算法的中国女性尿失禁发病危险因素研究

引用
目的:应用机器学习中的随机森林算法探讨中国女性尿失禁(UI)发病的危险因素,并评价各危险因素对于UI发病的预测效果。方法:采用多阶段分层整群抽样,在全国调查55 477例成年女性UI情况;基线调查于2014年2月至2016年1月完成,2018年6月至12月电话随访;最终纳入基线无UI且随访UI诊断指标数据完整的对象。采用欠采样技术,按照1∶1的比例从随访时未发生UI的人群中随机抽取与随访对新发UI相等人数作为对照,将这些调查对象的研究数据按照7∶3的比例随机分成训练集和测试集。将单因素分析中 P<0.2的候选变量,带入训练集并采用随机森林算法建模,在训练集筛选UI发病的危险因素,根据重要性对危险因素排序,并在测试集中验证。 结果:共30 658例(55.26%,30 658/55 477)完成随访,中位随访时间3.7年。纳入本研究的24 985例基线无UI的对象中,随访调查UI发病人数为1 757例(7.03%,1 757/24 985),其中压力性UI 1 117例(4.47%,1 117/24 985),急迫性UI 243例(0.97%,243/24 985),混合性UI 397例(1.59%,397/24 985)。随机森林模型固定特征数量为2个、决策树数量为300棵时,平均袋外估计误差率最低,此时模型分类准确率为64.3%,敏感度为64.2%,特异度为64.4%。根据Gini系数平均下降量,得到预测UI发病的前10位影响因素依次为:年龄、分娩次数、分娩方式、体质指数(BMI)、绝经状态、糖尿病史、教育程度、盆腔手术史、城乡分布、婚姻状况。结论:应用机器学习中的随机森林算法,从复杂的多因素中识别出预测中国女性UI发病的前10位影响因素,依次为:年龄、分娩次数、分娩方式、BMI、绝经状态、糖尿病史、教育程度、盆腔手术史、城乡分布、婚姻状况。

尿失禁、危险因素、随机分配、算法、机器学习、纵向研究、随机森林

56

国家重点研发计划2018YFC2002201;中国医学科学院医学与健康科技创新工程2017-I2M-1-002;National Key Research and Developmnet Program of China2018YFC2002201;Chinese Academy of Medical Sciences Initiative for Innovative Medicine2017-I2M-1-002

2023-05-30(万方平台首次上网日期,不代表论文的发表时间)

共7页

554-560

暂无封面信息
查看本期封面目录

中华妇产科杂志

0529-567X

11-2141/R

56

2021,56(8)

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn