收藏本站
《哈尔滨工程大学》 2010年
收藏 | 手机打开
二维码
手机客户端打开本文

数据挖掘中决策树分类算法的研究与改进

徐洪伟  
【摘要】:分类技术是数据挖掘领域中一种非常重要的研究方法。近几十年来,信息技术的高速发展造就了新一代数据的出现,而这一类数据都有着相似的特性,即高速的、高维的、连续的、动态的、快速变化的、海量的数据集合。如何有效合理利用这些庞大复杂的数据让其为我们服务,成为数据挖掘领域中分类技术要解决的问题。面对这些高维、连续的、动态的复杂数据,传统的分类算法已不能够有效的对这些数据进行分类处理。因此,要进行分类就必须针对现有分类算法的缺点进行研究,针对分类算法的缺点提出改进,使改进的分类算法能更好的处理复杂数据。 针对现有的决策树分类算法的不足,本文从以下几个方面进行改进。首先针对决策树分类算法处理连续属性数据时分类准确性不足的缺点,本文给出了一种BMIC离散化算法的改进算法—New-BMIC离散化算法,该离散化算法能够改善原有BMIC离散化算法在离散化合并的过程中模糊合并的不足,精确离散区间数,达到更好的离散化效果,提高对连续属性的分类精度;其次,针对现有决策树分类算法在处理属性选择时过度拟合、计算效率低下问题,本文给出了一种新的属性选择标准—方差规约,该方法是根绝方差的计算方式来衡量决策树拆分标准,从理论上该方法替代了对数的计算,提高了属性选择标准的计算效率,整体上可以降低决策树分类算法的时间复杂度,使其在应用领域上可以达到及时性、准确性;最后,将属性选择标准和新的离散化算法两个部分进行组合,使改进后决策树分类算法能够有效处理连续属性数据,同时也能减少过度拟合和提高决策树整体的分类效率。最后通过实验验证了改进算法的有效性和正确性。
【学位授予单位】:

知网文化
【相似文献】
中国期刊全文数据库 前20条
1 林艳;于书举;;决策树分类算法ID3的应用研究[J];企业科技与发展;2009年08期
2 樊敏;;应用决策树分析影响高校学生就业的因素[J];科技创新导报;2009年31期
3 袁保社;仲爱红;;决策树分类算法在寿险客户数据挖掘中的应用[J];电脑知识与技术(学术交流);2007年16期
4 曲守宁;卢健;;C4.5分类算法在硕士研究生智育测评中的应用[J];济南大学学报(自然科学版);2009年03期
5 沈晨鸣;;决策树分类算法研究[J];盐城工学院学报(自然科学版);2005年04期
6 张薇;;一种基于改进SLIQ决策树分类算法的应用研究[J];苏州大学学报(工科版);2010年01期
7 李慧慧;万武族;;决策树分类算法C4.5中连续属性过程处理的改进[J];计算机与现代化;2010年08期
8 王荣;陈纯;;基于属性选择算法的数据挖掘在离网预测模型中的应用[J];计算机应用与软件;2007年11期
9 郑启鹏 ,李秀 ,刘文煌 ,李兵;支持向量机在银行贷款客户分类中的应用研究[J];微计算机信息;2005年23期
10 王凯;贺国平;侯伟真;;支持向量机在商业银行客户管理中的应用研究[J];微电子学与计算机;2007年01期
11 赵静娴;倪春鹏;詹原瑞;杜子平;;一种大规模数据库的组合优化决策树算法[J];系统工程与电子技术;2009年03期
12 杨学兵;张俊;;决策树算法及其核心技术[J];计算机技术与发展;2007年01期
13 孙名松;邸明星;王湛昱;;多决策树算法在P2P网络流量检测中的应用[J];计算机技术与发展;2010年06期
14 但小容;陈轩恕;刘飞;柳德伟;;数据挖掘中决策树分类算法的研究与改进[J];软件导刊;2009年02期
15 蒲元芳;杜红乐;;决策树在网络入侵检测中的研究与应用[J];电脑知识与技术;2010年07期
16 王苗;柴瑞敏;;一种改进的决策树分类属性选择方法[J];计算机工程与应用;2010年08期
17 汪加才,常青;面向机器学习与数据挖掘实践教学的自由软件分析[J];南京审计学院学报;2004年03期
18 李华锋;吴友蓉;;数据挖掘中的预处理技术研究[J];成都纺织高等专科学校学报;2010年02期
19 赛煜,郑显臣;知识发现过程应用——一个原型系统设计[J];济南职业学院学报;2005年02期
20 朱玉全;宋余庆;杨鹤标;陈健美;;基于频繁模式树的关联分类规则挖掘算法[J];江苏大学学报(自然科学版);2006年03期
中国重要会议论文全文数据库 前10条
1 冷春霞;王翰虎;;一种高效的决策树分类算法[A];第十六届全国数据库学术会议论文集[C];1999年
2 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
3 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
4 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
5 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
6 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
7 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
8 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
9 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
10 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 徐洪伟;数据挖掘中决策树分类算法的研究与改进[D];哈尔滨工程大学;2010年
2 邵慧;保护隐私的分类挖掘技术研究[D];河北工程大学;2010年
3 陶金强;基于决策树的人才管理系统的设计与实现[D];电子科技大学;2010年
4 孙晓璇;基于决策树分类算法的高职学生就业分析与预测[D];云南大学;2012年
5 李小平;多关系决策树分类算法的研究[D];内蒙古大学;2011年
6 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
7 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
8 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
9 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
10 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
中国知网广告投放
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62982499
  • 010-62783978