收藏本站
收藏 | 论文排版

基于扩展概念格的多数据源分类知识融合问题研究

马冯  
【摘要】:数据挖掘领域里,分类问题一直以来都是的一个重要研究分支。在当前多数据源数据日益普及的情况下,对数据挖掘领域中分类问题的研究也提出了新的挑战,例如如何从多个数据源中提取出分类知识,并加以有效的融合。因此,研究一种有效的多数据源分类知识融合方法已成为当前数据库中知识发现的一个重要的研究方向。 概念格,是一种通过概念间的内涵和外延以及例化和泛化的关系来表示知识的模型。在概念格的内涵中引入等价关系,便可得到概念格的扩展模型,即扩展概念格,这种模型更加有利于分类知识的提取。本文的主要研究内容如下: 1.采用基于扩展概念格的方式,首先在每个数据源上建立对应的扩展概念格,然后从中提取出所需的分类知识,再加以有效的融合。文中涉及到了两种方式的知识表现形式:分类规则和分类子格,和与它们相对应的两种融合机制。对于这两种融合机制所得到的分类知识的完备性,都在文中给与了理论证明和实验验证。 2.对概念格扩展模型采用预剪枝的策略,来抑制过拟合现象的出现。概念格扩展模型具有较高的模型复杂度,一方面使其能够对训练数据集进行十分准确的分类,另一方面有会使得它很容易引起模型“过度拟合”现象的出现,从而影响到分类器在实际测试数据上的准确率;对此文中采用了对格进行预剪枝的方法,阻止格中部分不必要的分支的出现,从而降低模型的复杂度,避免模型过度拟合现象的出现。 3.在上述研究工作的基础上,实现了基于多扩展概念格的分类知识发现原型系统。


知网文化
【相似文献】
中国期刊全文数据库 前20条
1 张春华,王阳;数据挖掘技术、应用及发展趋势[J];现代情报;2003年04期
2 鲁光男;;KDD在高校教育中的应用[J];长春大学学报;2008年12期
3 钱红;KDD在现代图书馆中的应用[J];农业图书情报学刊;2005年11期
4 王磊,王文云,王乔;基于软件构件技术的KDD算法的设计与实现[J];计算机工程与设计;2005年09期
5 魏先民;王玉玲;;粗集在KDD系统中的应用与研究[J];潍坊学院学报;2005年04期
6 杨江平;;知识发现及其在图书馆的应用研究[J];图书馆学研究;2008年07期
7 蓝海根;马峻;;关系型数据库中关联规则挖掘与实现技术[J];机械管理开发;2006年02期
8 吴云;;KDD技术及其应用[J];阴山学刊(自然科学版);2006年01期
9 张艳;;基于数量型数据挖掘的模糊概念关联规则[J];计算机时代;2009年10期
10 邹先霞,王淑礼,魏长华;数据仓库与数据挖掘技术浅谈[J];高等函授学报(自然科学版);2000年03期
11 陈岚岚,杨波,李旭霞;数据挖掘技术及其发展方向[J];武警工程学院学报;2002年04期
12 彭佳红;一种基于粗糙集的混合特征选择算法[J];计算机工程与科学;2005年11期
13 郭竑晖;;教育信息挖掘的探讨[J];电脑知识与技术(学术交流);2006年29期
14 赵丹群;数据挖掘:原理、方法及其应用[J];现代图书情报技术;2000年06期
15 郑宏珍,柳明欣;数据挖掘及其工具的选择[J];计算机应用;1999年S1期
16 赵海青,李社宗,周幸福,乔雨,申建毅;数据库中的知识发现及其在气象中的应用[J];河南气象;2002年02期
17 刘耀南;;浅析数据挖掘及其应用[J];电脑知识与技术;2010年33期
18 苏旸,王法能,张敏情;计算智能方法在KDD系统中的应用与研究[J];计算机工程与应用;2002年03期
19 张红军;谈谈数据挖掘技术及其应用[J];广西梧州师范高等专科学校学报;2003年03期
20 张小平,马垣;KDD中的数据清理技术研究[J];鞍山科技大学学报;2003年02期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62982499
  • 010-62783978