收藏本站
收藏 | 手机打开
二维码
手机客户端打开本文

数据挖掘中的分类方法及其在质谱数据中的应用

贺平  
【摘要】:数据挖掘在化学中的一个重要的应用是从数据库中提取有用的信息,从而根据化合物相应的分子结构,拓扑指数或者化学指纹图谱对化合物进行分类和识别。随着化学测量技术和现代信息技术的发展,越来越多的包含大量化合物和化学信息的大型数据库被建立,例如:质谱数据库,色谱数据库或者基于分子结构和其他性质的数据库。如何发现隐藏在这些大型数据库中的知识是一个巨大的挑战。 质谱仪是一种用来对化合物进行鉴别和特征化的仪器技术,它产生了大量的有助于化学结构解析的数据。根据质谱鉴别化合物和识别化学结构性质一直都是化学计量学中一项重要的工作。本文首先对多元统计分析,人工智能和现代数据挖掘中的各种分类方法进行了深入的讨论,其中一些方法已被用于基于质谱数据的化学结构和性质的智能识别。但是,仍然有很多的化学结构或子结构不能被现有分类器有效的识别。从而寻找更好更适合质谱数据的方法仍然是化学计量学中一个重要的工作。 在这篇论文里,我们提出了将分类树和逆切片回归法(SIR)结合的新方法,并将这种方法用于质谱数据的分类问题。分类树是数据挖掘中最常用的一种分类工具,它在自动选择变量和体现交互作用方面具有强大的功能。分类树已经被广泛的用于质谱数据的分类。但如果输入变量是以某种线性组合的方式起作用,决策树往往会因为无法体现这种方式导致模型的复杂化和准确性的降低。逆切片回归法正是一种在高维数据中找出有用的变量的线性组合来回归响应变量的方法。所以有效的结合这两种方法可以继承它们的优点,使树结构也可体现变量间的线性组合关系。实验表明这种方法的确提高了决策树分类的准确性,而且与一些经典的分类方法相比,它可以得到更好试验结果。 助推法(boosting)是近代分类方法中的一个重要发展,它已经被成功的用于很多领域,但是在化学计量学中,几乎没有任何的应用。在这篇论文里,我


知网文化
【相似文献】
中国期刊全文数据库 前20条
1 李波霞;魏玉辉;席莉莉;段好刚;武新安;;近红外光谱和化学计量学对不同产地不同产期当归的定性研究[J];光谱实验室;2011年04期
2 李炳燃;张金哲;;数据挖掘在设备故障诊断专家系统知识获取中的应用[J];科技信息;2011年20期
3 朱渊萍;;一种新的时间序列相似性模式发现算法[J];海南师范大学学报(自然科学版);2011年02期
4 薛熠;曹正正;;图书超期原因的矩阵模型研究[J];武汉船舶职业技术学院学报;2011年04期
5 谢文阁;王海虹;;一种改进的基于距离的孤立点挖掘算法的研究[J];渤海大学学报(自然科学版);2011年02期
6 张长海;胡孔法;陈崚;宋爱波;;一种高效的基于位图序列模式挖掘算法[J];高技术通讯;2010年02期
7 吕学明;周艳红;吕国英;;关联规则在医疗投诉资料分析中的应用[J];太原师范学院学报(自然科学版);2011年02期
8 张雅芬;王新;;一种挖掘负关联规则的有效方法[J];云南民族大学学报(自然科学版);2011年04期
9 刘德钦;马维军;;基于属性归纳的人口空间分布规律挖掘[J];测绘科学;2008年S2期
10 毛伊敏;杨路明;李宏;陈志刚;刘立新;;一种有效的数据流最大频繁模式挖掘算法[J];高技术通讯;2010年03期
11 毛伊敏;李宏;杨路明;刘立新;;基于滑动窗口的数据流最大频繁项集的挖掘[J];高技术通讯;2010年11期
12 刘乾喜;杨林;谭顺晖;章家培;刘唯学;汪秀丹;;汽车零部件企业竞争情报采集的策略研究[J];科技信息;2011年15期
13 张馨方;黄敏儿;;数字矿山建设及其现状简介[J];科技致富向导;2011年21期
14 张寒云;段鹏;;相关分析方法在数据约简中的应用[J];云南民族大学学报(自然科学版);2011年03期
15 靳志宏;徐奇;兰辉;;集装箱多式联运的多维数据分析与数据挖掘[J];集美大学学报(自然科学版);2011年04期
16 原建伟;;基于内容分析的数据挖掘研究[J];河北工业科技;2011年05期
17 冯山;游晋峰;;含负项的关联规则挖掘研究综述[J];四川师范大学学报(自然科学版);2011年05期
18 刘旭华;闵顺耕;何雄奎;张录达;;近红外光谱逆回归降维定量分析模型[J];光谱学与光谱分析;2011年08期
19 姜斌;罗阿理;赵永恒;;海量光谱中激变变星候选体的数据挖掘[J];光谱学与光谱分析;2011年08期
20 李玲俐;;数据挖掘中分类算法综述[J];重庆师范大学学报(自然科学版);2011年04期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国博士学位论文全文数据库 前10条
1 贺平;数据挖掘中的分类方法及其在质谱数据中的应用[D];四川大学;2005年
2 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
3 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
4 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
5 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
6 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
7 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
8 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
9 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
10 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
中国硕士学位论文全文数据库 前10条
1 杨锦瑜;质谱数据挖掘及中药色谱指纹图谱评价新方法[D];中南大学;2005年
2 孙小林;金融数据挖掘中的增量聚类算法及应用研究[D];华中科技大学;2004年
3 马丽娜;基于Web的数据挖掘技术研究[D];山东师范大学;2002年
4 赵彩云;数据挖掘在外贸业务分析决策系统中的应用研究[D];北京工业大学;2003年
5 汪毅;面向零售业客户关系管理的数据挖掘模型研究[D];湖南大学;2003年
6 王景;基于关联规则数据挖掘的研究[D];广西大学;2003年
7 高延铭;数据挖掘在通信行业CRM中的应用研究[D];中国海洋大学;2003年
8 林莉;化学计量学新算法在药物体系中的定量构效关系研究[D];湖南大学;2005年
9 刘玉锋;数据挖掘中关联规则算法的研究与应用[D];长春理工大学;2010年
10 张吉楠;机场预报预测系统的相关技术研究[D];河南大学;2010年
中国重要报纸全文数据库 前10条
1 早报记者 胡孝敏;跨国企业掘金中国“数据挖掘”市场[N];东方早报;2005年
2 本报记者褚宁;数据挖掘如“挖金”[N];解放日报;2002年
3 赵纪元;数据挖掘在CRM中的应用[N];人民邮电;2001年
4 吴勇毅;软件选型:数据挖掘是重点[N];中国冶金报;2009年
5 刘光强;靠数据挖掘抓住客户的心[N];中国计算机报;2009年
6 本报记者 郭白岩;大众点评网向数据挖掘要收益[N];中国经营报;2011年
7 赵骏飞;数据挖掘在金融行业的应用[N];中国保险报;2011年
8 本报记者 黎宇文;博时基金王德英: 数据挖掘促进基金精细化管理[N];中国证券报;2011年
9 吴辅世;打破数据挖掘的5个神话[N];中国计算机报;2003年
10 ;数据挖掘:如何挖出效益?[N];中国计算机报;2004年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62982499
  • 010-62783978