收藏本站
《武汉大学》 2004年
收藏 | 手机打开
二维码
手机客户端打开本文

基于XML的Web数据挖掘技术的研究

蒲秋梅  
【摘要】:网络技术已经渗透到了社会生活的方方面面,随着Internet在世界范围内的迅速发展,越来越多的数据库和信息系统不断加入网络,使得Internet发展为当今世界上门类最全、规模最大的信息库。伴随计算能力的增长,智能算法的成熟及大规模数据存储技术的成熟,面对缤纷复杂的Web空间,如何从浩如烟海的网络中发掘所需信息成为人们所关注的一个主要问题,Web数据挖掘使解决这个问题的一个有效手段。 本文首先介绍了数据挖掘的一些基本概念、方法和技术、工具,阐明了什么是数据挖掘、为什么要数据挖掘、如何进行数据挖掘、数据挖掘的主要过程、数据挖掘所涉及到的技术、分类及数据挖掘和OLAP(在线分析处理)等的联系等,并介绍了有关数据挖掘发展情况。 在论述了数据挖掘技术理论之后,研究了数据挖掘技术在WWW上的应用,其中,阐述了XML的产生与发展、特点以及和HTML的比较,然后,详细探讨了Web挖掘的内容、流程、任务,它与数据挖掘的联系与区别。在Web上的半结构化数据处理上,利用XML数据抽取技术将半结构化数据映射为结构化数据、建立了一个Web数据挖掘系统的原型Web_mining,目的是提供一个实用的Web挖掘工具的模型,帮助人们更有效地从Web上获取知识。 本文最后在Web挖掘的基础上,将Agent技术引入数据挖掘,提出了一种基于Agent技术的体系结构,并指出了Web挖掘研究的方向、应用前景和它所面临的挑战。
【学位授予单位】:武汉大学
【学位级别】:硕士
【学位授予年份】:2004
【分类号】:TP311.13

【相似文献】
中国期刊全文数据库 前10条
1 张韬;胡旻;;互联网Web数据挖掘模型设计与技术实现[J];卫星与网络;2010年10期
2 王艳;;数据隐私保护技术综述[J];知识经济;2011年14期
3 杜垒;王飞;;数据挖掘在学生管理中的应用[J];科技信息;2011年18期
4 胡锟;杨路明;;浅谈移动CRM客户价值细分[J];电脑知识与技术;2011年13期
5 李想;;PLE编码在关联数据挖掘中的应用[J];电脑知识与技术;2011年15期
6 张博;张超伟;;中药方剂数据挖掘中的数据预处理研究[J];电脑知识与技术;2011年17期
7 宋向红;王慧军;;数据挖掘技术的主要应用及发展动态[J];黑龙江科技信息;2011年15期
8 杜英;;关联规则挖掘研究[J];知识经济;2011年14期
9 李炳燃;张金哲;;数据挖掘在设备故障诊断专家系统知识获取中的应用[J];科技信息;2011年20期
10 李丹实;;使用SQL Server2005构建数据挖掘应用程序[J];煤炭技术;2011年07期
中国重要会议论文全文数据库 前10条
1 丁瑾;;基于Web数据挖掘的综述[A];山西省科学技术情报学会学术年会论文集[C];2004年
2 易虹;许德刚;;Web数据挖掘的研究与应用[A];第一届全国Web信息系统及其应用会议(WISA2004)论文集[C];2004年
3 吴珊;杨桦;;基于日志挖掘的Web预取模型[A];2006年电气工程教育专业委员会年会论文集[C];2006年
4 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
5 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
6 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
7 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
8 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
9 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
10 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
中国重要报纸全文数据库 前10条
1 早报记者 胡孝敏;跨国企业掘金中国“数据挖掘”市场[N];东方早报;2005年
2 吴勇毅;软件选型:数据挖掘是重点[N];中国冶金报;2009年
3 刘光强;靠数据挖掘抓住客户的心[N];中国计算机报;2009年
4 本报记者 郭白岩;大众点评网向数据挖掘要收益[N];中国经营报;2011年
5 赵骏飞;数据挖掘在金融行业的应用[N];中国保险报;2011年
6 本报记者 黎宇文;博时基金王德英: 数据挖掘促进基金精细化管理[N];中国证券报;2011年
7 本报记者褚宁;数据挖掘如“挖金”[N];解放日报;2002年
8 吴辅世;打破数据挖掘的5个神话[N];中国计算机报;2003年
9 ;数据挖掘:如何挖出效益?[N];中国计算机报;2004年
10 ;数据挖掘流程[N];人民邮电;2001年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 张承明;基于Web的数据挖掘研究[D];山东科技大学;2003年
2 蒲秋梅;基于XML的Web数据挖掘技术的研究[D];武汉大学;2004年
3 陈敏;基于Web使用挖掘的知识发现研究[D];合肥工业大学;2005年
4 祝效普;WEB用户访问序列模式挖掘[D];天津大学;2005年
5 郭鹏;基于Web数据挖掘分类算法的个性化信息服务[D];太原理工大学;2003年
6 冶红;基于数据挖掘的Web挖掘系统的研究[D];大连理工大学;2003年
7 彭希鸿;基于Web内容挖掘的网页分类与过滤研究与应用[D];中南大学;2003年
8 潘延军;基于用户浏览内容的Web用户浏览行为个性化研究[D];天津大学;2005年
9 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
10 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026