基于GEP的流数据分类压缩并行算法研究
万方数据知识服务平台
应用市场
我的应用
会员HOT
万方期刊
×

点击收藏,不怕下次找不到~

@万方数据
会员HOT

期刊专题

10.3969/j.issn.1001-6600.2013.03.014

基于GEP的流数据分类压缩并行算法研究

引用
针对数据挖掘中流数据分类精度不高,数据压缩率低的问题,提出一种基于粒度分析与转存式GEP的流数据分类压缩并行算法,实现流数据的快速并行分类压缩.首先使用粒度分析技术对流数据的属性求得极小粒度集,根据划分规则得到近似粒度空间,然后根据不同类型流数据建立不同的GEP分类器模型,最后采用动态转存记录集形式,将数据送至GEP压缩模型实施压缩.再将串行算法扩展到MPI+OpenMP混合编程模型后得到其并行算法,采用UCI数据、通讯账单验证算法的性能.实验结果表明,分类压缩效果耗时较理想,压缩比效果明显,其中在校学生通讯账单耗时在96 s左右,压缩比达到1/3.

分类压缩、粒度分析、GEP、并行算法

31

TP393(计算技术、计算机技术)

国家自然科学基金资助项目61163012;广西自然科学基金资助项目2012GXNSFAA053218;广西高校科学技术研究资助项目2013YB147;广西研究生教育创新计划资助项目YCSZ2012099

2013-12-09(万方平台首次上网日期,不代表论文的发表时间)

共7页

87-93

相关文献
评论
暂无封面信息
查看本期封面目录

广西师范大学学报(自然科学版)

1001-6600

45-1067/N

31

2013,31(3)

相关作者
相关机构

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn