收藏本站
《吉林大学》 2011年
收藏 | 手机打开
二维码
手机客户端打开本文

频繁子树优化查询策略

赵炎  
【摘要】:现阶段,数据挖掘不论是在理论上还是在应用上都得到快速的发展。所谓数据挖掘,简而言之,就是从海量的数据中发现先前未知的、有用的信息。数据挖掘的重要性主要体现在计算机网络、Web挖掘、生物信息学、多关系数据挖掘、XML文档挖掘等方面的大量应用上 近几年,随着数据挖掘的发展,频繁子树的挖掘已经成为一个新的研究领域,在许多方面得到很好的实际应用,频繁模式挖掘是数据挖掘中一个很重要的课题。如何快速找到频繁结构,查询访问更新频繁结构信息,并对该结构进行必要的更新操作是迫在眉睫的时代要求。 在Dietz编码(属于区域编码)的基础之上,本文提出一种新的编码方案——PLDC编码(Parent Level Dietz Coding)。利用PLDC对XML文档树中节点进行编码,给定任何一个节点,在XML文档树中都可以找到从根节点到该节点的唯一的一条完整路径。该编码适用于给文档树建立索引,并继续运用到将XML文档转换为关系数据表之后的索引。另外将XML文档转换成关系数据表形式,用编码建立索引表,给出任何一个节点,在索引表中都能找到该节点的所有出现,并根据该节点的编码获得节点信息,不需要从根节点开始查找。此外针对XML文档中自下而上频繁子树(Bottom-up Frequent Subtree),鉴于其格式统一,将该部分转换到关系数据表中。实验结果表明,对包含自下而上频繁子树的XML文档,算法可以有效地进行查询、访问、更新等操作。相关工作得到吉林省科学技术发展计划(20090704)“半结构化数据库关键技术研究”项目支持。
【学位授予单位】:吉林大学
【学位级别】:硕士
【学位授予年份】:2011
【分类号】:TP311.13

【相似文献】
中国期刊全文数据库 前10条
1 邹翔,张巍,刘洋,蔡庆生;分布式序列模式发现算法的研究[J];软件学报;2005年07期
2 姜毅;乐庆玲;;基于决策树的协同进化分类算法研究[J];电脑知识与技术(学术交流);2007年13期
3 朱海平;王忠浩;张国军;邵新宇;;基于数据挖掘的通用物料清单重构方法研究[J];计算机集成制造系统;2008年02期
4 龚振志;胡孔法;达庆利;张长海;;DMGSP:一种快速分布式全局序列模式挖掘算法[J];东南大学学报(自然科学版);2007年04期
5 陈超祥;叶时平;华成;金林樵;;基于XML的完全频繁查询模式挖掘算法[J];计算机应用;2008年06期
6 潘有能;;基于XML的Web日志挖掘研究[J];现代图书情报技术;2006年05期
7 李继腾;骆志刚;丁凡;田文颖;赵琦;;最大频繁子图挖掘算法研究[J];计算机工程与科学;2009年12期
8 王运鹏;胡修林;阮幼林;;一种最大频繁模式的快速挖掘算法[J];计算机应用研究;2006年10期
9 陈小辉;文佳;邢海波;王凌飞;;一种基于候选树分割的分布式并行Apriori算法[J];计算机应用;2006年S2期
10 周涛;;逆向索引FP-tree挖掘频繁项集[J];现代电子技术;2007年04期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 佘晓华;单汨源;任斌;;基于数据挖掘的项目族工作分解结构模型构建研究[A];信息化、工业化融合与服务创新——第十三届计算机模拟与信息技术学术会议论文集[C];2011年
3 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
4 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
5 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
6 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
7 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
8 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
9 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
10 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026