收藏本站
《哈尔滨工程大学》 2003年
收藏 | 手机打开
二维码
手机客户端打开本文

基于元知识的数据挖掘系统研究

许兆新  
【摘要】: 从大量数据中抽取出有价值的信息和运行规律的数据挖掘技术在数据库技术发展了30余年的今天,无论是对商业经营还是工企决策,都有极其重要的经济价值和理论意义,但此新兴领域还有许多尚待解决的问题,还处于创新者提出概念研究者去解决问题的阶段。目前市场上已有多种适用商业模式的通用数据挖掘系统,但实际上这些系统极其不好用,只有那些非常熟悉数据挖掘技术的人才能够理解和使用它们,而普通用户是很难应用这些技术来解决自己的问题。 原因在于传统的数据挖掘模型缺乏充分表达挖掘目标的手段和必要的交互性且其评价标准单一,不能满足当前实际应用的需要。尽管通过设计高效算法及优化策略,会在某种程度上缓解这一矛盾,但并不能真正解决这一问题。本文以面向用户为原则,试图从数据挖掘系统的整体结构的高度来探讨解决这一问题的方法,其研究重点是提出基于元知识的数据挖掘系统模式并设计灵活、实用的算法。 本文的目的是赋予数据挖掘系统三个重要属性:交互性,可控性,易用性。由于用户不了解数据挖掘领域,他不知道要挖掘的是哪种类型的信息及如何正确表达系统需要他表达的思想,甚至不可能了解面对的数据库,元知识描述领域知识使得在这些方面能给与用户最大的帮助,本文给出了符合元数据交换标准的数据挖掘用元知识的内容、组织方式和应用模型,提出了基于元知识的数据挖掘系统体系结构,使数据库与数据挖掘系统真正融合,使领域知识在组织、表达、使用上有依据,为指导挖掘过程提供了手段,使数据量规模化有依据,数据源多样化有规范、可控制。 关联规则是数据挖掘研究的重要内容,高效的算法是数据挖掘的重要组成部分,而且面对复杂的多方面的需求,应提供针对各种因素的各具特色的互补的多种算法,本文详尽地研究了基于约束的关联规则挖掘算法的思想,深入地研究了约束的分类、确定其可利用的性质,在此基础上提出了针对联合约束中前驱和后继重叠时的改进策略和复杂聚集约束的转换方法。本文还给出了支持度匹配模式、0支持度约束等概念及模式匹配原则,引进枚举树确定模式最小支持度,设计了支持可变支持度约束的算法。 哈尔滨工程大学博士学位论文 元知识为灵活实现上述算法提供了支持手段。 最后,提出了利用信息增益选择约束的方法,给出了基于元知识的关 联规则挖掘系统的操作流程,探讨了可视化的功能实现问题,提出了在结 果评价阶段将评价规则作为元知识统一到挖掘过程中的思想,以利于提高 全系统的挖掘效率和准确性。 本文为实现以人为中心的探索性数据挖掘及提高其实用性作了初步 的探索工作。
【学位授予单位】:哈尔滨工程大学
【学位级别】:博士
【学位授予年份】:2003
【分类号】:TP311.13

【相似文献】
中国期刊全文数据库 前10条
1 丁纪云,蔡春娥;利用构造数据集评定数据挖掘过程的方法[J];湖南广播电视大学学报;2001年02期
2 任承业,罗伟其;校园信息系统中CRM与数据挖掘的结合和应用[J];计算机工程与应用;2003年13期
3 王艳;数据挖掘在数字图书馆中的应用[J];情报科学;2003年02期
4 邵红全,赵茜;用SQL Server2000实现数据挖掘的技术与策略[J];电脑开发与应用;2003年04期
5 耿庆鹏,卢子芳;利用数据挖掘技术实现对电信行业用户欺诈行为的预测[J];电信快报;2003年10期
6 蒋良孝,蔡之华;基于数据仓库的数据挖掘研究[J];计算技术与自动化;2003年03期
7 叶静,蔡之华;遥感图像中的数据挖掘应用概述[J];计算机与现代化;2003年10期
8 黄解军,万幼川,潘和平;银行客户关系管理与数据挖掘的应用[J];计算机工程与设计;2003年07期
9 崔强,朱卫东;基于数据挖掘的铁路机务段成本控制系统[J];铁路计算机应用;2003年01期
10 杨思春;基于数据仓库的数据挖掘技术分析研究[J];微机发展;2003年09期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 许兆新;基于元知识的数据挖掘系统研究[D];哈尔滨工程大学;2003年
2 李兴森;智能知识及其管理模式研究[D];中国科学院研究生院;2008年
3 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
4 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
5 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
6 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
7 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
8 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
9 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
10 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026