典型文献
基于随机投影与集成学习的离群点检测算法
文献摘要:
针对传统基于相似度的离群点检测算法在高维不均衡数据集上效果不够理想的问题,提出一种新颖的基于随机投影与集成学习的离群点检测(ensemble learning and random projection-based outlier detection,EROD)框架.算法首先集成多个随机投影方法对高维数据进行降维,提升数据多样性;然后集成多个不同的传统离群点检测器构建异质集成模型,增加算法鲁棒性;最后使用异质模型对降维后的数据进行训练,训练后的模型经过两次优化组合以降低泛化误差,输出最终的对象离群值,离群值高的对象被算法判定为离群点.分别在四个不同领域的高维不均衡真实数据集上进行对比实验,结果表明该算法与传统离群点检测算法和基于集成学习的离群点检测算法相比,在AUC和precision@n值上平均提高了3.6%和14.45%,证明EROD算法具有处理高维不均衡数据异常的优势.
文献关键词:
数据挖掘;离群点检测;随机投影;集成学习
中图分类号:
作者姓名:
郭一阳;于炯;杜旭升;曹铭
作者机构:
新疆大学 信息科学与工程学院,乌鲁木齐830091;新疆大学 软件学院,乌鲁木齐830091;中国海洋大学信息科学与工程学院,山东 青岛266100
文献出处:
引用格式:
[1]郭一阳;于炯;杜旭升;曹铭-.基于随机投影与集成学习的离群点检测算法)[J].计算机应用研究,2022(09):2608-2614
A类:
B类:
随机投影,集成学习,离群点检测,检测算法,不均衡数据集,ensemble,learning,random,projection,outlier,detection,EROD,投影方法,高维数据,数据多样性,检测器,异质集成,集成模型,加算,次优,优化组合,泛化误差,离群值,真实数据,precision,数据异常
AB值:
0.288176
相似文献
机标中图分类号,由域田数据科技根据网络公开资料自动分析生成,仅供学习研究参考。