收藏本站
《中国科学技术大学》 2006年
收藏 | 手机打开
二维码
手机客户端打开本文

范例推理与互联网文本信息处理研究

耿焕同  
【摘要】:近年来,范例推理(Case-Based Reasoning,CBR)的基础研究及系统实现正受到人们的普遍关注,是当今人工智能研究的前沿课题。CBR不仅是关于人类认知的心理学理论,而且将成为智能计算机系统技术中新的基石之一。CBR技术在知识不良定义和专家知识不全的领域中应用效果很好,但CBR系统中仍存在着知识获取和维护瓶颈问题。另一方面,数据挖掘(Data Mining,DM)技术是从大量数据中发现知识,因此是解决知识获取和维护瓶颈问题的有效途径之一。将范例推理研究与数据挖掘技术相结合,是具有重要意义的研究方向。 随着互联网的普及,Web文本资源已呈现几何级数的增长,有效地获取蕴藏在Web文本资源中的大量未知的、有用的信息,正成为国内外学者关注的研究热点。其中Web文本的预处理和文本理解又是互联网文本信息处理基础性工作,该工作必将有力地推动计算机对大规模Web文本资源的自动处理。 随着人工智能技术的不断成熟,专家系统技术正被研究者引入到互联网文本信息处理领域中,为理解互联网文本信息开辟了新的研究方向。 本论文围绕以上几个方面,进行了深入的研究。论文的主要内容为: 首先,将数据挖掘技术引入到范例推理系统中,解决系统中的知识获取和维护瓶颈问题。主要的工作有:一是结合数据挖掘中的聚类算法与脚标数据的特点,给出了一种有效的基于能力的范例库自动建立新方法;二是结合基于选择的CLARA聚类方法和NCL聚类算法的优点,给出了一种无监督下对范例进行准确归类聚类学习算法,该方法能大大地提高范例提取的速度和质量;三是给出了基于聚类方法的范例删除和范例增加维护策略。以上这些都将有利于增强CBR系统解决问题的有效性和实用性。此外还针对传统数据抽查方法很难保证数据抽查有效性的缺点,结合离群数据挖掘的方法,给出了一种基于离群数据挖掘的数据抽查新方法。该方法能克服传统数据抽查方法的缺陷,从而保证了数据抽查的有效性和全面性。 其次,开展了对互联网文本信息自动处理中的主题词自动抽取和文档自动摘要等基础性工作的研究。具体包括:一是在对现有主题词抽取方法深入研究的基础上,提出了一种基于词共现图的文档主题词自动抽取新方法,该方法以词频统
【学位授予单位】:中国科学技术大学
【学位级别】:博士
【学位授予年份】:2006
【分类号】:TP391.1

手机知网App
【相似文献】
中国期刊全文数据库 前10条
1 王艳;;数据隐私保护技术综述[J];知识经济;2011年14期
2 杜垒;王飞;;数据挖掘在学生管理中的应用[J];科技信息;2011年18期
3 胡锟;杨路明;;浅谈移动CRM客户价值细分[J];电脑知识与技术;2011年13期
4 李想;;PLE编码在关联数据挖掘中的应用[J];电脑知识与技术;2011年15期
5 张博;张超伟;;中药方剂数据挖掘中的数据预处理研究[J];电脑知识与技术;2011年17期
6 杜英;;关联规则挖掘研究[J];知识经济;2011年14期
7 李炳燃;张金哲;;数据挖掘在设备故障诊断专家系统知识获取中的应用[J];科技信息;2011年20期
8 李丹实;;使用SQL Server2005构建数据挖掘应用程序[J];煤炭技术;2011年07期
9 张红艳;都娟;;关联规则中Apriori算法的应用[J];数字技术与应用;2011年08期
10 吴旭东;柳炳祥;;聚类分析在高校图书馆管理中的应用[J];电脑开发与应用;2011年09期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国重要报纸全文数据库 前10条
1 早报记者 胡孝敏;跨国企业掘金中国“数据挖掘”市场[N];东方早报;2005年
2 吴勇毅;软件选型:数据挖掘是重点[N];中国冶金报;2009年
3 刘光强;靠数据挖掘抓住客户的心[N];中国计算机报;2009年
4 本报记者 郭白岩;大众点评网向数据挖掘要收益[N];中国经营报;2011年
5 赵骏飞;数据挖掘在金融行业的应用[N];中国保险报;2011年
6 本报记者 黎宇文;博时基金王德英: 数据挖掘促进基金精细化管理[N];中国证券报;2011年
7 本报记者褚宁;数据挖掘如“挖金”[N];解放日报;2002年
8 吴辅世;打破数据挖掘的5个神话[N];中国计算机报;2003年
9 ;数据挖掘:如何挖出效益?[N];中国计算机报;2004年
10 ;数据挖掘流程[N];人民邮电;2001年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 赵鹏;数据挖掘在范例推理和地理信息系统中的应用研究[D];安徽大学;2003年
2 孙小林;金融数据挖掘中的增量聚类算法及应用研究[D];华中科技大学;2004年
3 马丽娜;基于Web的数据挖掘技术研究[D];山东师范大学;2002年
4 赵彩云;数据挖掘在外贸业务分析决策系统中的应用研究[D];北京工业大学;2003年
5 王景;基于关联规则数据挖掘的研究[D];广西大学;2003年
6 高延铭;数据挖掘在通信行业CRM中的应用研究[D];中国海洋大学;2003年
7 刘玉锋;数据挖掘中关联规则算法的研究与应用[D];长春理工大学;2010年
8 张吉楠;机场预报预测系统的相关技术研究[D];河南大学;2010年
9 周绪倩;基于电子商务的Web数据挖掘系统架构研究[D];河北工程大学;2010年
10 高伟华;基于BP神经网络的WEB数据挖掘[D];中南民族大学;2010年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026