收藏本站
《中南民族大学》 2010年
收藏 | 手机打开
二维码
手机客户端打开本文

基于BP神经网络的WEB数据挖掘

高伟华  
【摘要】: WEB文本挖掘是WEB数据挖掘的一个研究方向,WEB文本挖掘过程中最重要的是如何对文档内容进行有效分类,文本分类精度越高,WEB查询结果就越接近于理想的要求,在实际的应用中越能够让使用者满意,所以如何设计一个高效的文本分类算法至关重要。在众多的分类算法里,BP神经网络算法因其:可以把一组样本的I/O问题变为一个非线性问题;实现I/O非线性映射;全局逼近网络;泛化能力等特点而被广泛应用。本文对WEB数据挖掘的发展和应用作了介绍,讨论了WEB数据挖掘的相关内容,并对使用的算法进行了概述,在前人工作的基础上,对WEB内容挖掘过程中涉及到的WEB文档分类的相关算法进行了讨论,着重对BP神经网络算法进行了深入的探讨,并在此基础上给出了自己的BP神经网络改进算法,将此算法应用在多子网并联拓扑结构上对WEB文档内容进行分类,实验结果表明改进算法的性能有了明显改善。论文具体的研究内容包括以下几方面: ⑴介绍了论文的研究背景及意义,对数据挖掘的概念、数据挖掘的分类、使用的挖掘算法、数据挖掘的过程等进行了详细的阐述。 ⑵着重对WEB数据挖掘的内容,WEB数据挖掘的分类,WEB数据挖掘的过程进行了阐述,尤其对WEB内容挖掘的挖掘内容、挖掘过程、相关算法进行了详细的阐述。在WEB内容挖掘过程中,对文档内容进行分类非常重要。 ⑶论文对神经网络算法的内容、原理进行了阐述,尤其对BP神经网络算法详细阐述了其概念、原理、拓扑结构及优缺点等,针对其收敛率不高和误差偏大等特点,对算法进行了改进,提出了BP神经网络改进算法,提高了算法的收敛率并降低了误差。 ⑷多子网并联神经网络算法是通过优化普通三层BP神经网络算法的拓扑结构,从而提高BP神经网络算法性能的一种方法。本文把改进的BP神经网络算法和多子网并联拓扑结构结合使用,使得算法的分类能力有了更大的改进。实验结果表明使用多子网并联结构的BP改进算法进行WEB文档分类可行,且性能有了较大的提高。
【学位授予单位】:中南民族大学
【学位级别】:硕士
【学位授予年份】:2010
【分类号】:TP311.13

【引证文献】
中国硕士学位论文全文数据库 前3条
1 曹路舟;关联规则算法在高职院校贫困生认定工作中的应用[D];安徽大学;2011年
2 许艺枢;面向云计算的DDoS攻击检测研究[D];齐齐哈尔大学;2012年
3 林士杰;ID3算法、朴素贝叶斯算法和BP神经网络算法的比较和分析研究[D];内蒙古大学;2013年
【参考文献】
中国期刊全文数据库 前10条
1 范亚芹,刘颖,李兴男;Web数据挖掘原理及实现[J];吉林大学学报(信息科学版);2003年04期
2 袁勇,万幼川;基于Web数据挖掘模型的研究[J];地理空间信息;2004年03期
3 赵岩;赵慧娟;;数据挖掘理论与技术[J];福建电脑;2006年02期
4 邹涛,王继成,朱华宇,金翔宇,张福炎;WWW上的信息挖掘技术及实现[J];计算机研究与发展;1999年08期
5 刘山,刘峨;基于Web结构数据挖掘技术的数学方法[J];计算机工程;2002年07期
6 潘昊,王晓勇,陈琼,黄少銮;基于遗传算法的BP神经网络技术的应用[J];计算机应用;2005年12期
7 刘晓鹏,邢长征;基于WEB文本数据挖掘的研究[J];计算机与数字工程;2005年09期
8 马保国;侯存军;王文丰;钱方正;;Web数据挖掘技术及应用[J];计算机与数字工程;2006年06期
9 涂承胜,鲁明羽,陆玉昌;Web内容挖掘技术研究[J];计算机应用研究;2003年11期
10 赵跃;佘诗武;;基于Web内容挖掘技术的应用研究[J];科技情报开发与经济;2008年36期
【共引文献】
中国期刊全文数据库 前10条
1 张世海,刘晓燕,欧进萍;高层结构智能选型知识发现及方法比较[J];四川建筑科学研究;2005年05期
2 潘洁珠;半结构化数据及其数据模型[J];安徽教育学院学报;2003年06期
3 邓亚超;陈彪;;模糊神经网络在火灾探测系统中的应用[J];安防科技;2012年03期
4 范进;;产业结构对产业集群影响力的实证分析[J];安徽广播电视大学学报;2006年04期
5 于立红;杜芸;;数据挖掘中数据预处理方法与技术[J];安徽电子信息职业技术学院学报;2009年04期
6 赵鹏,倪志伟,贾瑞玉;基于数据挖掘技术的范例库维护[J];安徽大学学报(自然科学版);2003年02期
7 舒坚;郑诚;陈振;;基于关联分类方法的Web使用挖掘研究[J];安徽大学学报(自然科学版);2006年02期
8 梁佩佩,杨丽萍;基于模糊关系数据库的聚类算法研究[J];安徽职业技术学院学报;2004年01期
9 章曙光;耿焕同;;一种改进的基于聚类的范例添加删除维护模型[J];安徽建筑工业学院学报(自然科学版);2006年01期
10 李永森;潘若愚;李传军;;公共设施选址优化研究[J];安徽建筑工业学院学报(自然科学版);2009年06期
中国重要会议论文全文数据库 前10条
1 代广珍;徐超;;基于Web的数据挖掘研究综述[A];2005年“数字安徽”博士科技论坛论文集[C];2005年
2 章曙光;;基于CBR的电力负荷预测系统的研究与实现[A];2005年“数字安徽”博士科技论坛论文集[C];2005年
3 靖培栋;王英;;Web 2.0在政府信息工作中的应用[A];科学发展:社会管理与社会和谐——2011学术前沿论丛(上)[C];2011年
4 苏俊杰;钟秋海;许继平;;基于自适应遗传算法的径向基函数网络的呼吸周期预测研究[A];第二十九届中国控制会议论文集[C];2010年
5 张文广;史贤俊;肖支才;李新;;基于RBF神经网络的导弹舵机系统故障检测[A];第二十九届中国控制会议论文集[C];2010年
6 杨青;刘晔;张东旭;刘畅;;快速查找最优初始聚类数K的改进K-means算法[A];中国自动化学会控制理论专业委员会A卷[C];2011年
7 谢晓竹;侯冰;;基于改进自适应粒子群算法和BP神经网络的地面声目标识别[A];中国自动化学会控制理论专业委员会A卷[C];2011年
8 张文广;史贤俊;廖剑;李新;;RBF神经网络在惯导系统传递对准中的应用[A];中国自动化学会控制理论专业委员会C卷[C];2011年
9 查星云;;一种钢铁企业金属损耗平衡分析方法[A];全国冶金自动化信息网2012年年会论文集[C];2012年
10 薛志强;李毅;曹燕;;改进的BP神经网络在模拟电路故障诊断中的应用研究[A];2011下一代自动测试系统学术研讨会论文集[C];2011年
中国博士学位论文全文数据库 前10条
1 王杰;基于人工智能的乒乓球比赛技战术诊断与评估研究[D];上海体育学院;2010年
2 戴运桃;粒子群优化算法研究及其在船舶运动参数辨识中的应用[D];哈尔滨工程大学;2010年
3 冷欣;船用增压锅炉汽包水位预测控制方法研究[D];哈尔滨工程大学;2009年
4 于翔;基于网格的数据流聚类方法研究[D];哈尔滨工程大学;2010年
5 牟向伟;模糊语义个性化推荐系统在电子政务中的应用研究[D];大连海事大学;2010年
6 全惠敏;电能质量相关信号的S变换检测算法及应用研究[D];湖南大学;2010年
7 丁文荣;云南省盘龙河流域河流悬移质输移变化及其对环境变化的响应[D];昆明理工大学;2008年
8 高贯斌;关节臂式坐标测量机自标定方法与误差补偿研究[D];浙江大学;2010年
9 戴小鹏;知识网格及其在农业生物灾害预警中关键技术研究[D];湖南农业大学;2010年
10 安璐;基于自组织映射的期刊主题研究[D];武汉大学;2009年
中国硕士学位论文全文数据库 前10条
1 李金华;基于SVM的多类文本分类研究[D];山东科技大学;2010年
2 吴香庭;基于遗传算法的K-means聚类方法的研究[D];山东科技大学;2010年
3 吴家瑞;服装产品加工成本快速估算方法研究[D];浙江理工大学;2010年
4 张娓娓;焦炭生产过程质量模型建模方法研究[D];郑州大学;2010年
5 郭洋;基于嵌入式零树图像压缩编码方法研究[D];哈尔滨工程大学;2010年
6 辛贵州;无人飞行器航迹规划算法研究[D];哈尔滨工程大学;2010年
7 冯为军;基于粗糙集理论的数据挖掘算法的研究[D];哈尔滨工程大学;2010年
8 孙原;基于酉变换的权威页面挖掘算法研究[D];哈尔滨工程大学;2010年
9 刘洁;基于关联挖掘的深层网络接口模式匹配方法的研究[D];哈尔滨工程大学;2010年
10 李晓光;数据挖掘技术在高校招生和教务管理中的应用[D];哈尔滨工程大学;2010年
【同被引文献】
中国期刊全文数据库 前10条
1 张步良;;基于分类概率加权的朴素贝叶斯分类方法[J];重庆理工大学学报(自然科学);2012年07期
2 徐川;杜成;唐红;;DDoS攻击检测研究综述[J];电信科学;2011年03期
3 况莉莉;;Apriori算法与FP-tree算法的探讨[J];淮北煤炭师范学院学报(自然科学版);2010年02期
4 严华;陈文菁;;关联规则在学生成绩分析中的应用[J];福建医科大学学报(社会科学版);2008年01期
5 刘永琴;高校贫困生的现状、成因及其对策[J];高教探索;2001年01期
6 吕静;;BP与RBF比较研究[J];电脑开发与应用;2013年01期
7 尤磊;兰洋;;一种改进的FP-Growth关联规则挖掘算法的实现[J];河南科技;2010年11期
8 许晓东;范艳华;朱士瑞;;基于宏观网络流相关性的DDoS攻击检测[J];计算机工程;2011年10期
9 张洁;秦拯;;改进的基于熵的DDoS攻击检测方法[J];计算机应用;2010年07期
10 张琛;王亮;熊文柱;;P2P僵尸网络的检测技术[J];计算机应用;2010年S1期
中国博士学位论文全文数据库 前1条
1 刘刚;数据挖掘技术与分类算法研究[D];中国人民解放军信息工程大学;2004年
中国硕士学位论文全文数据库 前10条
1 梅俊;数据挖掘中关联规则算法的研究及应用[D];安徽工程大学;2010年
2 耿三靖;数据挖掘技术在高校教学评价中的应用研究[D];河南理工大学;2010年
3 张睿;ID3决策树算法分析与改进[D];兰州大学;2010年
4 董雪;基于IG_NN双层属性选择的客户流失预警研究[D];天津财经大学;2010年
5 李冬;ID3算法的优化研究及其在构件库中的应用[D];昆明理工大学;2011年
6 刘振岩;数据挖掘分类算法的研究与应用[D];首都师范大学;2003年
7 彭涛;数据挖掘技术在实时网络入侵检测系统中的应用[D];吉林大学;2004年
8 盛立;基于粗糙集理论的数据挖掘方法的研究[D];山东师范大学;2006年
9 施亚明;数据挖掘在信用卡客户细分与目标营销方面的应用研究[D];东南大学;2006年
10 宋茹桦;关联规则挖掘算法研究与应用[D];山东大学;2006年
【二级参考文献】
中国期刊全文数据库 前10条
1 宋伟,王举成,马根峰,赵济林;Internet数据挖掘原理及实现[J];重庆邮电学院学报(自然科学版);2001年02期
2 施建强,刘晓平;基于遗传算法的数据挖掘技术的研究[J];电脑与信息技术;2003年01期
3 范并思;胡小菁;;图书馆2.0:构建新的图书馆服务[J];大学图书馆学报;2006年01期
4 周军兰;;Google数字图书馆项目的多方博弈分析[J];大学图书馆学报;2006年05期
5 刘降珍;;基于Web的数据挖掘技术[J];福建电脑;2008年03期
6 李海滨;基于Web的数据挖掘[J];桂林工学院学报;2003年02期
7 潘昊,钟珞,陈杰;BP 神经网络训练的函数变步长搜索调整法[J];湖北工学院学报;1997年02期
8 何鲲,朱方洲;基于Web的数据挖掘方法的研究及实现[J];合肥学院学报(自然科学版);2005年02期
9 董晓常;Web2.0互联网再次喧嚣[J];互联网周刊;2005年24期
10 冯艳,王坚强;数据挖掘技术在电子商务上的应用[J];湖南商学院学报;2002年02期
中国硕士学位论文全文数据库 前1条
1 刘洋;基于Web的内容挖掘技术研究[D];哈尔滨工程大学;2003年
【相似文献】
中国期刊全文数据库 前10条
1 丁纪云,蔡春娥;利用构造数据集评定数据挖掘过程的方法[J];湖南广播电视大学学报;2001年02期
2 任承业,罗伟其;校园信息系统中CRM与数据挖掘的结合和应用[J];计算机工程与应用;2003年13期
3 王艳;数据挖掘在数字图书馆中的应用[J];情报科学;2003年02期
4 邵红全,赵茜;用SQL Server2000实现数据挖掘的技术与策略[J];电脑开发与应用;2003年04期
5 耿庆鹏,卢子芳;利用数据挖掘技术实现对电信行业用户欺诈行为的预测[J];电信快报;2003年10期
6 蒋良孝,蔡之华;基于数据仓库的数据挖掘研究[J];计算技术与自动化;2003年03期
7 叶静,蔡之华;遥感图像中的数据挖掘应用概述[J];计算机与现代化;2003年10期
8 黄解军,万幼川,潘和平;银行客户关系管理与数据挖掘的应用[J];计算机工程与设计;2003年07期
9 崔强,朱卫东;基于数据挖掘的铁路机务段成本控制系统[J];铁路计算机应用;2003年01期
10 杨思春;基于数据仓库的数据挖掘技术分析研究[J];微机发展;2003年09期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026