收藏本站
《复旦大学》 2005年
收藏 | 手机打开
二维码
手机客户端打开本文

结构数据挖掘与处理的若干问题的研究

王晨  
【摘要】:目前,数据挖掘及其应用已经渗透到多个学科,并在人工智能与机器学习、数据库、模式识别、生物信息学、神经计算等领域取得了丰硕的成果。同时,数据挖掘也不仅是科学家的兴趣所在,更多地得到了政府、工业界的密切关注。通过引进数据挖掘的能力,可以大大提高生产力,取得社会的更大进步。世界上许多国家和地区的政府及工业界都希望掌握数据挖掘技术,提升国家和企业的科技含量,并最终取得领先的地位。 随着研究的深入,越来越多的问题呈现在我们面前,也提出了更高的要求。当前,复杂类型数据的挖掘需求上升,专家学者开始关注这方面的新应用和理论研究,并试图利用无结构化数据挖掘方面的经验和方法论来帮助解决新问题。而针对结构数据的挖掘与处理就是本文所致力研究的问题。 本文针对结构数据挖掘与处理目前存在的几个关键问题进行了研究,包括提高半结构化数据挖掘的速度与效率、提高图结构数据挖掘的可量测性和处理速度、约束条件下的图结构数据挖掘的方法、图结构数据索引技术。本文的创造性研究成果主要有: (1) 提出了4个频繁子树挖掘算法,分别是Chopper、XSpanner、ESMiner、ISMiner。分别采取了序列增长技术和最右路径增长技术,挖掘嵌入式子树和导出式子树模式。实验结果表明这些算法的运行效率良好,在性能上优于目前已提出的子树挖掘算法。 (2) 提出了一个新颖的子图索引结构ADI,并将其应用于频繁子图挖掘过程中,形成了图挖掘算法ADI-Mine和图挖掘应用系统GraphMiner。实验结果表明,ADI在一定程度上避免了子图同构判断的巨大代价,提高了算法的效率和可量测性。通过与目前世界上认可的最快的图挖掘算法gSpan比较,ADI-Mine无论从可量测性上还是从时间效率上,都大大优于对方。在此基础上,还提出了将ADI移植到其他图挖掘算法中的想法,进一步提高效率。 (3) 总结了目前常用的图约束条件,并根据其特性将约束分成若干类别,最后提出了带约束的图挖掘算法CabGin。实验证明,通过聚集挖掘焦点,不仅可以减少噪声结果对分析造成的影响,还可以提高挖掘效率。
【学位授予单位】:复旦大学
【学位级别】:博士
【学位授予年份】:2005
【分类号】:TP311.13

手机知网App
【引证文献】
中国期刊全文数据库 前6条
1 王映龙;杨珺;周法国;唐建军;;加权最大频繁子图挖掘算法的研究[J];计算机工程与应用;2009年20期
2 尹四清;孔鹏程;张素兰;;利用编码的频繁导出式子树挖掘算法[J];计算机工程与应用;2011年24期
3 吴甲;陈崚;;一种快速的频繁子图挖掘算法[J];计算机应用;2008年10期
4 孔鹏程;张继福;;基于离散区间的频繁嵌入式子树挖掘算法[J];计算机应用;2009年04期
5 陈冬菊;张东站;段江娇;;基于子树约束的最大频繁子树挖掘算法[J];现代计算机(专业版);2010年05期
6 王映龙;杨炳儒;宋泽峰;陈卓;李琳娜;;一种挖掘最大频繁子图的新算法[J];系统仿真学报;2008年18期
中国博士学位论文全文数据库 前1条
1 曲吉林;时间序列挖掘中索引与查询技术的研究[D];天津大学;2006年
中国硕士学位论文全文数据库 前6条
1 陈立宁;频繁子图挖掘算法的研究[D];长沙理工大学;2011年
2 刘静;基于多层索引结构的频繁子图挖掘算法研究[D];陕西师范大学;2008年
3 吴甲;结构化数据的挖掘算法研究[D];扬州大学;2009年
4 孔鹏程;嵌入式与导出式频繁子树挖掘算法研究[D];太原科技大学;2009年
5 曾建平;XML文档最大频繁嵌入子树挖掘及其应用[D];大连理工大学;2012年
6 孙艳;面向RFID海量数据的图挖掘技术研究[D];扬州大学;2011年
【共引文献】
中国期刊全文数据库 前10条
1 谭峻松;首照宇;;一种分布式环境下动态挖掘频繁闭项集算法[J];大众科技;2010年09期
2 杨炳儒;张伟;钱榕;;面向语义的精简化多关系频繁模式发现方法[J];中国工程科学;2008年09期
3 汪卫,周皓峰,袁晴晴,楼宇波,施伯乐;基于图论的频繁模式挖掘[J];计算机研究与发展;2005年02期
4 颜跃进,李舟军,陈火旺;一种挖掘最大频繁项集的深度优先算法[J];计算机研究与发展;2005年03期
5 郭伟;叶德谦;;改进的基于FP-tree的频繁项集挖掘算法[J];计算机工程与应用;2007年19期
6 侯伟;杨炳儒;宋威;;多关系关联规则算法综述[J];计算机工程与应用;2007年23期
7 张伟;杨炳儒;钱榕;;多关系频繁模式发现研究[J];计算机科学;2007年07期
8 卢炎生,杨芬,赵栋;带单调约束的关联规则挖掘[J];计算机工程;2004年15期
9 赵栋,卢炎生;一种开采频繁项目集集合的快速算法[J];计算机工程与科学;2005年10期
10 赵栋,卢炎生,王涛;一种用于快速关联规则挖掘的分段信息表生成算法[J];计算机工程与科学;2005年11期
中国重要会议论文全文数据库 前1条
1 杨晓明;王晨;汪卫;张守志;施伯乐;;频繁项集的精简表达与还原问题研究[A];第二十一届中国数据库学术会议论文集(技术报告篇)[C];2004年
中国博士学位论文全文数据库 前6条
1 周皓峰;关联规则挖掘的拓展性研究[D];复旦大学;2003年
2 张小刚;关联规则挖掘及其在复杂工业过程控制中的应用研究[D];湖南大学;2002年
3 颜跃进;最大频繁项集挖掘算法的研究[D];国防科学技术大学;2005年
4 王智慧;信息共享中隐私保护若干问题研究[D];复旦大学;2007年
5 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
6 孙明;语义Web使用挖掘若干关键技术研究[D];电子科技大学;2009年
中国硕士学位论文全文数据库 前10条
1 杜焕;铁路隧道衬砌状态检测数据管理系统的研究与实现[D];北京交通大学;2010年
2 侯林娇;基于函数依赖的成批处理模式挖掘方法研究[D];湖南科技大学;2011年
3 胡睿;基于概念格的关联规则挖掘[D];华中师范大学;2003年
4 李广文;面向夹具CAD的知识挖掘技术的研究与应用[D];南京航空航天大学;2004年
5 杨芬;基于约束的关联规则挖掘[D];华中科技大学;2004年
6 崔海莉;基于CRM的数据挖掘技术研究及应用[D];合肥工业大学;2006年
7 武坤;快速生成关联规则的算法研究[D];河南大学;2006年
8 侯俊杰;一种基于索引的频繁模式算法研究[D];清华大学;2005年
9 王又武;基于动态数据的关联规则挖掘算法研究与应用[D];中南大学;2006年
10 张自敏;加权关联规则的研究[D];重庆大学;2008年
【同被引文献】
中国期刊全文数据库 前10条
1 戴勇军;张旻;;基于Apriori的改进的频繁模式挖掘算法[J];电子信息对抗技术;2009年06期
2 黄祥林,沈兰荪;基于内容的图像检索技术研究[J];电子学报;2002年07期
3 高琳;覃桂敏;周晓峰;;图数据中频繁模式挖掘算法研究综述[J];电子学报;2008年08期
4 于昕梅,夏定元,向政权;一种基于内容的图像检索方法研究与实现[J];桂林电子工业学院学报;2002年05期
5 程树明;古天龙;;基于拓扑子图与编辑距离的距离测量方法[J];桂林电子科技大学学报;2009年01期
6 李菁菁,邵培基,黄亦潇;数据挖掘在中国的现状和发展研究[J];管理工程学报;2004年03期
7 苏毅娟,严小卫;一种改进的频繁集挖掘方法[J];广西师范大学学报(自然科学版);2001年03期
8 吉根林;朱颖雯;;有序树的频繁子树挖掘研究[J];广西师范大学学报(自然科学版);2008年01期
9 徐欣;阮幼林;;最大频繁模式的挖掘算法[J];舰船电子工程;2009年03期
10 柯珂,张世英;ARCH模型的诊断分析[J];管理科学学报;2001年02期
中国重要会议论文全文数据库 前1条
1 陈子军;李伟;李霞;王鑫昱;;基于投影编码的频繁子树挖掘算法[A];第二十三届中国数据库学术会议论文集(研究报告篇)[C];2006年
中国博士学位论文全文数据库 前8条
1 冯红伟;数据挖掘技术的研究及应用[D];西北工业大学;2002年
2 周海燕;空间数据挖掘的研究[D];中国人民解放军信息工程大学;2003年
3 刘君强;海量数据挖掘技术研究[D];浙江大学;2003年
4 曾海泉;时间序列挖掘与相似性查找技术研究[D];复旦大学;2003年
5 杨风召;高维数据挖掘中若干关键问题的研究[D];复旦大学;2003年
6 王达;时间序列数据挖掘研究与应用[D];浙江大学;2004年
7 兰秋军;金融时间序列隐含模式挖掘方法及其应用研究[D];湖南大学;2005年
8 董道国;高维数据索引结构研究[D];复旦大学;2005年
中国硕士学位论文全文数据库 前10条
1 王君;基于FP-tree最大频繁模式超集挖掘算法[D];辽宁师范大学;2011年
2 江浩;面向相似性的时间序列表示与搜索方法研究[D];华中科技大学;2004年
3 郭林;面向XML文档的数据挖掘技术研究[D];大连理工大学;2005年
4 李环宇;一种基于搜索算法的关联规则发现及其更新研究[D];山东科技大学;2005年
5 陆声链;孤立点挖掘及其内涵知识发现的研究与应用[D];广西师范大学;2005年
6 尹金荔;基于相似性度量的图模式挖掘研究[D];西安电子科技大学;2007年
7 李伟;频繁子树挖掘研究[D];燕山大学;2007年
8 朱颖雯;频繁子树挖掘及其在XML挖掘中的应用研究[D];南京师范大学;2008年
9 刘波;嵌入频繁子树挖掘研究[D];西南交通大学;2008年
10 陈炳超;基于XML的WEB数据挖掘研究[D];暨南大学;2008年
【二级引证文献】
中国期刊全文数据库 前10条
1 郭小芳;李锋;宋晓宁;;一种基于PCA的时间序列异常检测方法[J];江西师范大学学报(自然科学版);2012年03期
2 裴丽鹊;;一种基于分段线性的FKD时间序列模式表示[J];赤峰学院学报(自然科学版);2008年07期
3 裴丽鹊;;一种基于滑动窗口的时间序列异常检测算法[J];巢湖学院学报;2011年03期
4 何洁月;赵德京;;一种高效的生物网络概率模体发现算法[J];东南大学学报(自然科学版);2012年01期
5 秦文;;基于Voronoi图的时间序列线性模式查询算法[J];计算机工程与应用;2008年31期
6 陈立宁;罗可;;Apriori算法用于频繁子图挖掘的改进方法[J];计算机工程与应用;2011年10期
7 潘伟涛;郝跃;谢元斌;史江一;;小规模频繁子电路的规律性预提取算法[J];计算机辅助设计与图形学学报;2010年02期
8 陈立宁;罗可;;基于Apriori图挖掘算法的优化及其在3D构造解析的应用[J];计算机应用;2010年12期
9 郭景峰;柴然;张伟;;基于FSG的最大频繁子图挖掘算法[J];计算机应用研究;2010年09期
10 李正欣;张凤鸣;李克武;;多元时间序列模式匹配方法研究[J];控制与决策;2011年04期
中国重要会议论文全文数据库 前1条
1 邱均平;王菲菲;;时间序列相似性查询与索引方法研究[A];2009年中国索引学会年会暨学术研讨会论文集[C];2009年
中国博士学位论文全文数据库 前2条
1 张可;矩阵型灰色关联分析建模技术研究[D];南京航空航天大学;2010年
2 李星毅;基于相似性的交通流分析方法[D];北京交通大学;2010年
中国硕士学位论文全文数据库 前9条
1 刘军伟;基于正交变换的时间序列索引[D];大连理工大学;2010年
2 严兆斌;序列模式挖掘在公路隧道交通中的应用研究[D];西安电子科技大学;2009年
3 魏龙;GML时空序列模式挖掘研究[D];江西理工大学;2011年
4 周庆兰;多元时间序列异常检测的研究[D];西南交通大学;2011年
5 荣梅;基于地磁的智能交通检测技术[D];湘潭大学;2011年
6 柴然;最大频繁子图挖掘算法研究[D];燕山大学;2010年
7 陈立宁;频繁子图挖掘算法的研究[D];长沙理工大学;2011年
8 苏东海;基于地磁感应的交通流检测方法研究[D];天津大学;2007年
9 曾建平;XML文档最大频繁嵌入子树挖掘及其应用[D];大连理工大学;2012年
【相似文献】
中国期刊全文数据库 前10条
1 郭鑫;骆期裕;徐洪智;;频繁子树挖掘算法综述[J];软件导刊;2009年12期
2 李玉华;罗汉果;孙小林;;一种基于Apriori思想的频繁子图发现算法[J];计算机工程与科学;2007年04期
3 任薇;周杨;;FSM——基于子图同构和结构同构的频繁子图挖掘算法(英文)[J];西南大学学报(自然科学版);2008年06期
4 李继腾;骆志刚;丁凡;田文颖;赵琦;;最大频繁子图挖掘算法研究[J];计算机工程与科学;2009年12期
5 詹卫许;王桂娟;;基于频繁子图的图分类方法研究[J];现代计算机(专业版);2010年03期
6 常鹏;陈耿;朱玉全;;一种分布式序列模式挖掘算法[J];计算机应用;2008年11期
7 唐德权;夏幼明;张丽英;;基于图的数据挖掘算法研究[J];云南师范大学学报(自然科学版);2007年05期
8 王映龙;杨炳儒;宋威;宋泽锋;;宽度优先的频繁子图高效挖掘新算法[J];系统工程与电子技术;2008年03期
9 张焕生;崔炳德;王政峰;徐德生;;基于图的频繁子结构挖掘算法综述[J];信息化纵横;2009年10期
10 赵传申;孙志挥;张净;;基于投影分支的快速频繁子树挖掘算法[J];计算机研究与发展;2006年03期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
6 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
7 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
8 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 裴维玲;呼叫中心与数据挖掘,谁先上?[N];网络世界;2001年
中国博士学位论文全文数据库 前10条
1 王晨;结构数据挖掘与处理的若干问题的研究[D];复旦大学;2005年
2 马海兵;频繁模式挖掘相关技术研究[D];复旦大学;2005年
3 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
4 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
5 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
6 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
7 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
8 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
9 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
10 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
3 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
4 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
5 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
6 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
7 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
8 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
9 李森;基于数据挖掘的旅游电子商务系统研究与实现[D];电子科技大学;2011年
10 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026