收藏本站
《吉林大学》 2010年
收藏 | 手机打开
二维码
手机客户端打开本文

数据挖掘中半监督K-均值聚类算法的研究与改进

刘方  
【摘要】: 数据挖掘技术是当前机器学习、模式识别、计算机科学、智能计算技术、应用数学、统计学习方法以及智能机器人研究中的重要课题。它能从已有的数据中分析、提炼和挖掘出隐含的、先前未知的、对决策有潜在应用价值的知识。 本文围绕数据挖掘领域的聚类分析问题,展开了算法与应用研究:在传统的K-均值聚类算法的基础上,为了提高算法的效率,提出了两种基于数据分段技术选取初始聚类中心的改进的K-均值聚类算法,将上述算法应用到我国各地区城镇居民家庭收支基本情况统计数据中,取得了较好效果;结合半监督学习方法,提出了半监督K-均值聚类算法,并针对初始聚类中心的选取提出了两种改进的半监督K-均值聚类算法,并将改进前后的算法应用于我国男性与女性身高和体重的统计数据中,取得了较好的效果。
【学位授予单位】:吉林大学
【学位级别】:硕士
【学位授予年份】:2010
【分类号】:TP311.13

手机知网App
【相似文献】
中国期刊全文数据库 前10条
1 赵向梅;王艳君;刘林;;聚类算法及聚类融合算法研究[J];电子设计工程;2011年15期
2 郑世明;苗壮;赵波;赵志宁;;基于网格的聚类挖掘算法[J];军械工程学院学报;2011年03期
3 彭宏玉;柴旭光;陈晓纪;;基于层次迭代思想的聚类算法的研究[J];唐山学院学报;2011年03期
4 金欣;王晶;沈奇威;;分布式最小生成树聚类的设计与实现[J];计算机系统应用;2011年07期
5 张俊溪;吴晓军;;一种新的基于进化计算的聚类算法[J];计算机工程与应用;2011年24期
6 潘锋;王建东;牛奔;;基于谱分析的无监督特征选择算法[J];计算机应用;2011年08期
7 苏孝强;倪宏;;一种基于空间相依性的移动对象聚类算法[J];微计算机应用;2011年05期
8 李金广;刘家磊;;基于最近邻思想的K-均值算法[J];中国科技信息;2011年17期
9 刘力雄;郭云飞;康晶;马宏;;分布式数据流聚类算法[J];计算机工程与设计;2011年08期
10 陶运信;皮德常;;一种快速移动对象轨道聚类算法[J];高技术通讯;2010年01期
中国重要会议论文全文数据库 前10条
1 孙浩军;孔令俊;刘志辉;;利用高斯分布生成数据对聚类算法的比较[A];2007'仪表,自动化及先进集成技术大会论文集(一)[C];2007年
2 郑健;皮德常;;基于共享最近邻的聚类和孤立点检测算法[A];第一届中国高校通信类院系学术研讨会论文集[C];2007年
3 于健;陈子军;李霞;李炜;;一种新的多密度聚类算法[A];2007北京地区高校研究生学术交流会通信与信息技术会议论文集(上册)[C];2008年
4 刘彤;孙永香;张振洪;;一种有效的基于密度和层次的聚类算法[A];2007'仪表,自动化及先进集成技术大会论文集(一)[C];2007年
5 余琳;邓玲;;常见聚类算法的比较以及DSS系统中的应用[A];湖北省通信学会、武汉通信学会2009年学术年会论文集[C];2009年
6 武森;金海燕;高学东;;数据挖掘中CABOSFV聚类算法的实现与应用[A];全国第八届工业工程与企业信息化学术会议论文集[C];2004年
7 李世峰;黄磊;刘昌平;;几种聚类方法的比较[A];第八届全国汉字识别学术会议论文集[C];2002年
8 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
9 刘洋;江志纲;丁增喜;王大玲;鲍玉斌;于戈;;一种基于图的聚类算法GB-Cluster[A];第十九届全国数据库学术会议论文集(技术报告篇)[C];2002年
10 吴继兵;李心科;;基于分治融合的混合属性数据聚类算法研究[A];全国第20届计算机技术与应用学术会议(CACIS·2009)暨全国第1届安全关键技术与应用学术会议论文集(下册)[C];2009年
中国重要报纸全文数据库 前10条
1 早报记者 胡孝敏;跨国企业掘金中国“数据挖掘”市场[N];东方早报;2005年
2 吴勇毅;软件选型:数据挖掘是重点[N];中国冶金报;2009年
3 刘光强;靠数据挖掘抓住客户的心[N];中国计算机报;2009年
4 本报记者 郭白岩;大众点评网向数据挖掘要收益[N];中国经营报;2011年
5 赵骏飞;数据挖掘在金融行业的应用[N];中国保险报;2011年
6 本报记者 黎宇文;博时基金王德英: 数据挖掘促进基金精细化管理[N];中国证券报;2011年
7 本报记者褚宁;数据挖掘如“挖金”[N];解放日报;2002年
8 吴辅世;打破数据挖掘的5个神话[N];中国计算机报;2003年
9 ;数据挖掘:如何挖出效益?[N];中国计算机报;2004年
10 ;数据挖掘流程[N];人民邮电;2001年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 万淼;基于群智能和随机索引的网络聚类算法研究[D];北京邮电大学;2011年
4 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
5 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
6 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
7 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
8 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
9 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
10 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
中国硕士学位论文全文数据库 前10条
1 谷垒;聚类算法及其在电信收入保障系统中的应用研究[D];湖南大学;2010年
2 高世光;基于模糊聚类的数据挖掘技术研究[D];国防科学技术大学;2002年
3 宋勇军;模糊C-均值算法改进研究[D];华中科技大学;2010年
4 刘赫;一个基于聚类算法的推荐系统的设计与实现[D];吉林大学;2005年
5 钟冠群;聚类算法在B2M电子商务中的应用研究[D];长春工业大学;2010年
6 张树魁;网络文本信息聚类算法研究与应用[D];北京交通大学;2009年
7 李红;数据挖掘中特征选择与聚类算法研究[D];大连理工大学;2010年
8 刘方;数据挖掘中半监督K-均值聚类算法的研究与改进[D];吉林大学;2010年
9 刘凌云;基于数据挖掘的银行信用风险管理方法研究[D];广东工业大学;2005年
10 孙晓霞;聚类分析在客户细分领域的应用研究[D];西北大学;2006年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026