典型文献
基于时序窗口的概念漂移类别检测
文献摘要:
流数据作为一种新型数据,在各个领域均有应用,其快速、大量及持续不断的特点使得单遍精准扫描成为在线学习算法的必备特质.在流数据不断产生过程中,往往会发生概念漂移,目前对于概念漂移节点检测的研究相对成熟,然而实际问题中学习环境因素朝不同方向发展往往会导致流数据中概念漂移类别的多样性,这给流数据挖掘及在线学习带来了新的挑战.针对这个问题,提出一种基于时序窗口的概念漂移类别检测(concept drift class detection based on time window,CD-TW)方法.该方法借助栈和队列对流数据进行存取,借助窗口机制对流数据进行分块学习.首先创建2个分别加载历史数据和当前数据的基础节点时序窗口,通过比较二者所包含数据的分布变化情况来检测概念漂移节点.然后创建加载漂移节点后部分数据的跨度时序窗口,通过分析该窗口中数据分布的稳定性检测漂移跨度,进而判断概念漂移类别.实验结果表明该方法不仅能够精确定位概念漂移节点,同时在漂移类别判断方面也表现出良好性能.
文献关键词:
流数据;概念漂移;时序窗口;漂移跨度;概念漂移类别
中图分类号:
作者姓名:
郭虎升;任巧燕;王文剑
作者机构:
山西大学计算机与信息技术学院 太原030006;计算智能与中文信息处理教育部重点实验室(山西大学) 太原030006
文献出处:
引用格式:
[1]郭虎升;任巧燕;王文剑-.基于时序窗口的概念漂移类别检测)[J].计算机研究与发展,2022(01):127-143
A类:
时序窗口,概念漂移类别,漂移跨度
B类:
流数据,描成,在线学习算法,移节,点检,学习环境,同方向,concept,drift,class,detection,window,CD,TW,存取,分块,先创,别加,历史数据,后部,口中,数据分布,稳定性检测,精确定位,好性
AB值:
0.212161
相似文献
机标中图分类号,由域田数据科技根据网络公开资料自动分析生成,仅供学习研究参考。