收藏本站
《长沙理工大学》 2010年
收藏 | 手机打开
二维码
手机客户端打开本文

数据挖掘中聚类算法的研究

刘坤朋  
【摘要】: 随着信息技术的迅速发展,人们积累了大量的数据。如何从这些冗余数据中提出对人们有用的信息就成了如今亟需要解决的问题。数据挖掘技术就在这种背景下应运而生,并且发展了几年就已经成为目前数据库和信息决策领域最为热门的课题和方向之一。作为数据挖掘中的一个重要分支,聚类分析是通过分析数据的相似性把大型数据集合分类,使得在同一个类里面的数据最为相似,而不同类中的数据又彼此相异,得到很好的分类效果。 本文主要研究了聚类算法,所做的主要工作如下: 1.利用密度聚类算法收敛速度快,层次聚类算法可以在不同粒度水平上对数据进行探测,而且容易实现相似度量或距离度量的优点,发现了一种新的基于密度的层次聚类算法,克服了层次聚类算法时间复杂度的问题,得到比较好的聚类结果。 2.将免疫算法引入模糊聚类算法,克服了模糊聚类算法对初始值敏感容易陷入局部最优的问题。新的聚类算法能够在不给定初始簇数目的条件下得到准确的聚类结果。 3.结合传统聚类算法与模糊聚类算法。利用密度算法对中心点不敏感的优点,将密度算法应用于模糊聚类,得到新的聚类算法应用于数据量大的数据集时,它的准确率要明显高于模糊聚类算法和免疫算法。
【学位授予单位】:长沙理工大学
【学位级别】:硕士
【学位授予年份】:2010
【分类号】:TP18

【相似文献】
中国期刊全文数据库 前10条
1 梁伍七,江克勤;数据挖掘中的模糊聚类分析及其应用[J];安庆师范学院学报(自然科学版);2004年02期
2 陈磊;余建坤;邢晓宇;;谱系聚类在综合国力分析中的应用[J];云南民族大学学报(自然科学版);2009年01期
3 夏师;梁碧珍;陆月然;罗明山;;聚类分析研究进展[J];现代计算机(专业版);2009年03期
4 仝磊光;谢景新;高明亮;;CLARA算法聚类蛋白质序列的实现[J];微计算机信息;2010年13期
5 王路漫;;FCM聚类算法在数字图书馆中的应用研究[J];内蒙古大学学报(自然科学版);2010年04期
6 谷淑化;吕维先;;基于消息传递的并行聚类算法[J];现代计算机;2006年01期
7 田瑞;周学君;;大型数据库中的聚类方法研究[J];计算机时代;2008年06期
8 苏锦旗;吴慧欣;薛惠锋;;基于人工鱼群算法的聚类挖掘[J];计算机仿真;2009年02期
9 侯卫彪;;基于聚类算法的入侵检测技术[J];现代计算机(专业版);2010年15期
10 张天伍;李卫平;;一种基于密度的引力聚类算法[J];河南科学;2008年11期
中国重要会议论文全文数据库 前10条
1 孙浩军;孔令俊;刘志辉;;利用高斯分布生成数据对聚类算法的比较[A];2007'仪表,自动化及先进集成技术大会论文集(一)[C];2007年
2 郑健;皮德常;;基于共享最近邻的聚类和孤立点检测算法[A];第一届中国高校通信类院系学术研讨会论文集[C];2007年
3 于健;陈子军;李霞;李炜;;一种新的多密度聚类算法[A];2007北京地区高校研究生学术交流会通信与信息技术会议论文集(上册)[C];2008年
4 刘彤;孙永香;张振洪;;一种有效的基于密度和层次的聚类算法[A];2007'仪表,自动化及先进集成技术大会论文集(一)[C];2007年
5 余琳;邓玲;;常见聚类算法的比较以及DSS系统中的应用[A];湖北省通信学会、武汉通信学会2009年学术年会论文集[C];2009年
6 武森;金海燕;高学东;;数据挖掘中CABOSFV聚类算法的实现与应用[A];全国第八届工业工程与企业信息化学术会议论文集[C];2004年
7 李世峰;黄磊;刘昌平;;几种聚类方法的比较[A];第八届全国汉字识别学术会议论文集[C];2002年
8 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
9 刘洋;江志纲;丁增喜;王大玲;鲍玉斌;于戈;;一种基于图的聚类算法GB-Cluster[A];第十九届全国数据库学术会议论文集(技术报告篇)[C];2002年
10 吴继兵;李心科;;基于分治融合的混合属性数据聚类算法研究[A];全国第20届计算机技术与应用学术会议(CACIS·2009)暨全国第1届安全关键技术与应用学术会议论文集(下册)[C];2009年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 万淼;基于群智能和随机索引的网络聚类算法研究[D];北京邮电大学;2011年
4 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
5 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
6 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
7 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
8 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
9 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
10 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
中国硕士学位论文全文数据库 前10条
1 谷垒;聚类算法及其在电信收入保障系统中的应用研究[D];湖南大学;2010年
2 高世光;基于模糊聚类的数据挖掘技术研究[D];国防科学技术大学;2002年
3 刘赫;一个基于聚类算法的推荐系统的设计与实现[D];吉林大学;2005年
4 孙玉侠;数据挖掘中的谱聚类算法研究[D];中国海洋大学;2010年
5 张树魁;网络文本信息聚类算法研究与应用[D];北京交通大学;2009年
6 李红;数据挖掘中特征选择与聚类算法研究[D];大连理工大学;2010年
7 刘方;数据挖掘中半监督K-均值聚类算法的研究与改进[D];吉林大学;2010年
8 刘凌云;基于数据挖掘的银行信用风险管理方法研究[D];广东工业大学;2005年
9 孙晓霞;聚类分析在客户细分领域的应用研究[D];西北大学;2006年
10 岳峰;聚类的边界点检测算法研究[D];郑州大学;2007年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026