收藏本站
《重庆大学》 2004年
收藏 | 手机打开
二维码
手机客户端打开本文

粗糙集属性约简算法在数据挖掘中的研究

于兴网  
【摘要】:随着数据库的不断增长,自动从数据库中获取有用的知识成为人们日益迫切的需要。粗糙集理论(Rougll Sets)就是在这样背景下不断发展起来的一种用于不精确、不确定数据挖掘与处理的新型数学理论。粗糙集理论也凭借其独特的优势而在KDD领域中具有越来越重要的地位。 属性约简是粗糙集理论研究的核心问题之一,本文首先介绍了Pawlak粗糙集模型以及决策表、可辨识矩阵和约简等基本概念,为后面章节中的属性约简算法打下了理论基础。 现已证明,寻找一个决策表的最小约简是NP-难问题,在人工智能中,解决这类问题的方法一般是使用启发式算法。 本文把属性重要性作为启发式信息,以核属性为寻求约简的起点,通过对算法中加入启发式信息,减少了搜索空间。给出了相对可辨识矩阵的概念,并以相对可辨识矩阵为基础,对属性约简的基本算法做出了改进,把本来是对可辨识矩阵进行逻辑运算的计算转化成代数运算,在一定程度上简化了计算,提高了约简效率。后面又提到了基于信息熵的相对属性约简算法。并在文章的最后提出了一种新的基于灰色关联度的属性约简算法,实验证明,该算法可以获得令人满意的约简。
【学位授予单位】:重庆大学
【学位级别】:硕士
【学位授予年份】:2004
【分类号】:TP311.13

【引证文献】
中国博士学位论文全文数据库 前1条
1 杨婷婷;基于数据的电站节能优化控制研究[D];华北电力大学(北京);2010年
中国硕士学位论文全文数据库 前10条
1 郑雅琼;基于数据挖掘的故障诊断方法研究[D];太原理工大学;2011年
2 张仁杰;粗糙集理论在电站运行优化中的应用研究[D];华北电力大学(北京);2011年
3 张楠;基于Rough Set理论的约简算法的研究[D];贵州大学;2007年
4 李智玲;基于区分矩阵的粗糙集属性约简算法在数据挖掘中的应用研究[D];太原理工大学;2007年
5 齐家宏;粗糙集方法在税务稽查中的研究与实践[D];兰州大学;2007年
6 邓国新;地区电网故障诊断系统中对错误信息辨识的研究[D];华北电力大学(北京);2008年
7 王双维;基于PCA的医疗数据特征提取方法研究及应用[D];中南大学;2008年
8 蔡成闻;S-粗集与数据筛选—过滤[D];山东大学;2008年
9 朱海洋;基于粗糙神经网络的WSN节点故障诊断[D];电子科技大学;2010年
10 马飞;基于变精度粗糙集的链箅机—回转窑球团矿专家系统的开发[D];东北大学;2008年
【参考文献】
中国期刊全文数据库 前10条
1 潘丹,郑启伦;属性约简自寻优算法[J];计算机研究与发展;2001年08期
2 苗夺谦,胡桂荣;知识约简的一种启发式算法[J];计算机研究与发展;1999年06期
3 王珏,王任,苗夺谦,郭萌,阮永韶,袁小红,赵凯;基于Rough Set理论的“数据浓缩”[J];计算机学报;1998年05期
4 王珏,苗夺谦;Analysis on Attribute Reduction Strategies of Rough Set[J];Journal of Computer Science and Technology;1998年02期
5 韩祯祥,张琦,文福拴;粗糙集理论及其应用综述[J];控制理论与应用;1999年02期
6 王珏;苗夺谦;周育健;;关于Rough Set理论与应用的综述[J];模式识别与人工智能;1996年04期
7 钟晓;马少平;张钹;俞瑞钊;;数据挖掘综述[J];模式识别与人工智能;2001年01期
8 常犁云,263.net,王国胤,263.net,吴渝,263.net;一种基于Rough Set理论的属性约简及规则提取方法[J];软件学报;1999年11期
9 苗夺谦,王珏;基于粗糙集的多变量决策树构造方法[J];软件学报;1997年06期
10 胡丹,莫智文;关于粗糙集理论与信息熵的几点注记[J];四川师范大学学报(自然科学版);2002年03期
【共引文献】
中国期刊全文数据库 前10条
1 赵彦辉;张乐文;邱道宏;仲晓杰;;基于粗糙集理论的隧道围岩模糊综合评判[J];四川建筑科学研究;2011年02期
2 吕俊;任雪萍;;一种基于粗糙集理论的变压器故障多变量决策树诊断方法[J];安徽电气工程职业技术学院学报;2011年01期
3 张安勤;数据挖掘与进化算法[J];安徽教育学院学报;2002年03期
4 于海涛;Rough集理论在数据约简中的应用[J];安徽教育学院学报;2004年03期
5 程家兴,钱付兰;粗糙集方法在基于属性分类中的应用[J];安徽大学学报(自然科学版);2005年01期
6 王永梅;胡学钢;;决策树中ID3算法的研究[J];安徽大学学报(自然科学版);2011年03期
7 杨萍,杨明;基于VPRS的重要属性评价方法研究[J];安徽工程科技学院学报(自然科学版);2003年01期
8 江效尧,胡林生;基于粗糙集的RDT决策树生成算法的研究及应用[J];安徽工程科技学院学报(自然科学版);2004年03期
9 叶明全;;数据挖掘在医疗数据中的应用[J];安徽工程科技学院学报(自然科学版);2007年03期
10 孙虹;方敏;;基于Rough集和RBF网络的车牌字符识别方法[J];安徽建筑工业学院学报(自然科学版);2006年04期
中国重要会议论文全文数据库 前10条
1 叶红云;倪志伟;陈恩红;;一种混合型集成学习演化决策树算法[A];2005年“数字安徽”博士科技论坛论文集[C];2005年
2 尹宗成;;粗糙集理论在我国粮食产量预测中的应用[A];现代农业理论与实践——安徽现代农业博士科技论坛论文集[C];2007年
3 危前进;董荣胜;孟瑜;崔更申;;基于粗糙集的机械装配知识发现方法[A];广西计算机学会25周年纪念会暨2011年学术年会论文集[C];2011年
4 王印松;冯康;;主汽温调节系统性能评价的粗糙集实现方法[A];第二十七届中国控制会议论文集[C];2008年
5 方炜炜;杨炳儒;彭珍;;一种基于粗糙集的启发式属性归约的新算法[A];第二十七届中国控制会议论文集[C];2008年
6 陈楚湘;沈建京;陈冰;尚长兴;王运成;;运用粗糙集理论建立中老年肺炎中医症候诊断标准[A];第二十九届中国控制会议论文集[C];2010年
7 何鹏;王雅琳;桂卫华;孔玲爽;;氧化铝硅渣成分的混沌时间序列分析与SVM预测[A];第二十九届中国控制会议论文集[C];2010年
8 ;Learning Algorithm of Decision Tree Generation for Continuous-valued Attribute[A];第二十九届中国控制会议论文集[C];2010年
9 陈楚湘;沈建京;陈冰;尚长兴;王运成;;运用粗糙集理论和Apriori算法建立中医症候诊断标准[A];中国自动化学会控制理论专业委员会D卷[C];2011年
10 王琦;;基于贝叶斯决策树算法的垃圾邮件识别机制[A];2011年通信与信息技术新进展——第八届中国通信学会学术年会论文集[C];2011年
中国博士学位论文全文数据库 前10条
1 殷志伟;基于统计学习理论的分类方法研究[D];哈尔滨工程大学;2009年
2 于翔;基于网格的数据流聚类方法研究[D];哈尔滨工程大学;2010年
3 杨锦园;基于传感器管理的移动机器人融合算法研究[D];华中科技大学;2010年
4 张明;电能质量扰动相关问题研究[D];华中科技大学;2010年
5 任家福;服务商选择与备件备品库存管理研究[D];电子科技大学;2010年
6 张目;高技术企业信用风险影响因素及评价方法研究[D];电子科技大学;2010年
7 渠瑜;基于SVM的高不平衡分类技术研究及其在电信业的应用[D];浙江大学;2010年
8 李建军;广东湛江红树林生态系统空间结构优化研究[D];中南林业科技大学;2010年
9 杨剑锋;适合并行的无干预文档聚类算法研究[D];武汉大学;2010年
10 温世亿;膨胀土渠坡若干关键技术问题研究[D];武汉大学;2010年
中国硕士学位论文全文数据库 前10条
1 贾莉莉;跳扩散模型下几种奇异期权的保险精算定价研究[D];山东科技大学;2010年
2 杨新忠;基于案例的地理时空过程表达模型研究[D];山东科技大学;2010年
3 岳海亮;信息论在粗糙集连续属性离散化中的应用[D];辽宁师范大学;2010年
4 雷聪聪;一种基于数据聚类的信息粒化方法[D];郑州大学;2010年
5 张晓冬;基于全矢谱的智能诊断技术研究[D];郑州大学;2010年
6 王晓换;基于粗糙集和神经网络的故障诊断虚拟系统的研究[D];郑州大学;2010年
7 曾祥莉;ETL在经济普查信息发布系统中的应用研究[D];哈尔滨工程大学;2010年
8 李伟光;基于BP神经网络的数据库模式匹配方法研究[D];哈尔滨工程大学;2010年
9 周霞;基于粗糙集的电子商务交易知识获取研究[D];哈尔滨工程大学;2010年
10 冯为军;基于粗糙集理论的数据挖掘算法的研究[D];哈尔滨工程大学;2010年
【同被引文献】
中国期刊全文数据库 前10条
1 沈诗林;于春雨;袁非牛;陈志斌;张永明;;一种基于视频图像相关性的火灾火焰识别方法[J];安全与环境学报;2007年06期
2 杜娟,余英林,谢胜利;基于粗糙集理论的自适应图像内插[J];北京理工大学学报;2005年11期
3 雷霖;代传龙;王厚军;;基于Rough set理论的无线传感器网络节点故障诊断[J];北京邮电大学学报;2007年04期
4 孙雨耕,张静,孙永进,房朝晖;无线自组传感器网络[J];传感技术学报;2004年02期
5 杜玉红;张晓敏;蔡成闻;;无线传感器网络能量均衡自适应分簇算法[J];传感技术学报;2007年07期
6 张劼;景博;张宗麟;孙勇;陈明;;无线传感器网络中基于比较的簇节点故障诊断算法[J];传感技术学报;2007年08期
7 蒋鹏;;一种改进的DFD无线传感器网络节点故障诊断算法研究[J];传感技术学报;2008年08期
8 陶志,许宝栋,汪定伟,李冉;一种基于粗糙集理论的连续属性离散化方法[J];东北大学学报;2003年08期
9 张铁岩,孙秋野,张化光,刘莉;基于不完整数据的粗糙集电网故障诊断方法[J];东北大学学报;2004年04期
10 吴成东;许可;韩中华;裴涛;;基于粗糙集和决策树的数据挖掘方法[J];东北大学学报;2006年05期
中国博士学位论文全文数据库 前10条
1 张磊;基于机器学习的图像检索若干问题研究[D];山东大学;2011年
2 苏健;基于粗糙集的数据挖掘与决策支持方法研究[D];浙江大学;2002年
3 冯志鹏;计算智能在机械设备故障诊断中的应用研究[D];大连理工大学;2003年
4 李学明;计算机数据的关联规则挖掘理论和算法研究[D];重庆大学;2003年
5 卢勇;数据信息采掘与热工过程控制优化[D];清华大学;2003年
6 于洪;Rough Set理论及其在数据挖掘中的应用研究[D];重庆大学;2003年
7 谭天乐;基于粗糙集的过程建模、控制与故障诊断[D];浙江大学;2003年
8 乔斌;粗糙集理论分层递阶约简算法的研究[D];浙江大学;2003年
9 王珏;粗糙集理论及其应用研究[D];西安电子科技大学;2005年
10 余廷芳;火电厂厂级监控信息系统(SIS)建模、实现及人工智能的应用研究[D];东南大学;2004年
中国硕士学位论文全文数据库 前10条
1 李莹;基于图像特征的隧道运动火源视频火焰探测技术研究[D];中国科学技术大学;2011年
2 李军;一种基于神经网络的专家系统的设计与实现[D];北京工业大学;2003年
3 孙向飞;粗糙集理论在电力系统中应用研究初探[D];昆明理工大学;2003年
4 植小三;基于粗糙集理论的数据挖掘模型及属性约简算法研究[D];重庆大学;2003年
5 李明祥;基于粗糙集理论的数据挖掘方法的研究[D];山东科技大学;2003年
6 王加成;粗糙集理论及其在生物发酵过程控制中的应用[D];浙江大学;2004年
7 李银花;基于粗糙集理论的属性约简算法研究及应用[D];华北工学院;2004年
8 李萌;基于粗集理论的数据挖掘的数据预处理研究[D];华中师范大学;2004年
9 林毅;基于粗集理论的关联规则挖掘的研究[D];广西大学;2004年
10 彭久生;基于粗糙集理论的关联规则挖掘方法研究[D];中南大学;2004年
【二级引证文献】
中国期刊全文数据库 前5条
1 何晓桃;郑文丰;宋晖;;基于主成分和支持向量机的降维和模式分类[J];淮阴工学院学报;2011年01期
2 袁桂丽;张健;杨婷婷;秦士伟;;基于免疫关联规则的烟气含氧量优化研究[J];华东电力;2012年11期
3 邵为爽;李晓红;;RS-BP神经网络在C2C电子商务顾客满意度评价中的应用[J];科技通报;2013年05期
4 李智玲;胡彧;;改进的属性约简算法在数据挖掘中的应用研究[J];计算机技术与发展;2012年10期
5 胡勇;张世荣;;机组运行优化系统数据接口平台设计[J];自动化与仪表;2013年07期
中国博士学位论文全文数据库 前3条
1 时长江;豆科类杂草种子图像识别系统研究[D];中国海洋大学;2009年
2 曲亚鑫;基于历史数据的偏最小二乘建模方法研究与应用[D];华北电力大学;2012年
3 闫姝;超超临界机组非线性控制模型研究[D];华北电力大学;2013年
中国硕士学位论文全文数据库 前10条
1 张仁杰;粗糙集理论在电站运行优化中的应用研究[D];华北电力大学(北京);2011年
2 张兴;地区电网二次报警信息智能处理系统的研究与开发[D];华北电力大学(北京);2011年
3 崔智婕;保护信息逻辑模型及其推理方法的研究[D];华北电力大学(北京);2011年
4 潘明;基于机器视觉的大张印刷质量光电检查系统研究[D];电子科技大学;2011年
5 陈月营;多机器人系统的全局协调故障诊断与容错控制[D];郑州大学;2011年
6 夏辉;面向税务稽查选案的信息处理方法[D];湖南大学;2009年
7 陈琳;尿沉渣有形成分自动识别[D];重庆大学;2010年
8 朱经纲;基于最小二乘支持向量机的球团矿质量分类建模[D];东北大学;2009年
9 杨尧;基于粗糙集理论的决策信息系统属性约简算法研究[D];青岛大学;2011年
10 高传海;基于双数据源的电网故障诊断方法的研究[D];华北电力大学(北京);2009年
【二级参考文献】
中国期刊全文数据库 前10条
1 欧阳为民,蔡庆生;一种在数据库中发现偏离模式的线性算法[J];计算机研究与发展;1998年10期
2 欧阳为民,蔡庆生;在大型数据库中多层序贯模式的发现[J];计算机研究与发展;1998年10期
3 铁治欣,陈奇,俞瑞钊;采掘关联规则的高效并行算法[J];计算机研究与发展;1999年08期
4 朱廷劭;高文;;KDD:数据库中的知识发现[J];计算机科学;1997年06期
5 王珏,王任,苗夺谦,郭萌,阮永韶,袁小红,赵凯;基于Rough Set理论的“数据浓缩”[J];计算机学报;1998年05期
6 吴福保,李奇,宋文忠;基于粗集理论知识表达系统的一种归纳学习方法[J];控制与决策;1999年03期
7 王珏;苗夺谦;周育健;;关于Rough Set理论与应用的综述[J];模式识别与人工智能;1996年04期
8 苗夺谦;王珏;;粗糙集理论中知识粗糙性与信息熵关系的讨论[J];模式识别与人工智能;1998年01期
9 欧阳为民,蔡庆生;在数据库中自动发现广义序贯模式[J];软件学报;1997年11期
10 苗夺谦,王珏;基于粗糙集的多变量决策树构造方法[J];软件学报;1997年06期
【相似文献】
中国期刊全文数据库 前10条
1 张新光,王建华;数据仓库信息处理技术研究[J];齐齐哈尔大学学报;2000年03期
2 丁纪云,蔡春娥;利用构造数据集评定数据挖掘过程的方法[J];湖南广播电视大学学报;2001年02期
3 任承业,罗伟其;校园信息系统中CRM与数据挖掘的结合和应用[J];计算机工程与应用;2003年13期
4 王艳;数据挖掘在数字图书馆中的应用[J];情报科学;2003年02期
5 邵红全,赵茜;用SQL Server2000实现数据挖掘的技术与策略[J];电脑开发与应用;2003年04期
6 耿庆鹏,卢子芳;利用数据挖掘技术实现对电信行业用户欺诈行为的预测[J];电信快报;2003年10期
7 蒋良孝,蔡之华;基于数据仓库的数据挖掘研究[J];计算技术与自动化;2003年03期
8 叶静,蔡之华;遥感图像中的数据挖掘应用概述[J];计算机与现代化;2003年10期
9 黄解军,万幼川,潘和平;银行客户关系管理与数据挖掘的应用[J];计算机工程与设计;2003年07期
10 崔强,朱卫东;基于数据挖掘的铁路机务段成本控制系统[J];铁路计算机应用;2003年01期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026