收藏本站
收藏 | 手机打开
二维码
手机客户端打开本文

化学信息学中的数据挖掘

胡黔楠  
【摘要】:化学信息数据带来了巨大的挑战与机遇。化学信息学这一门新的学科产生于科学家们对化学知识规律的不断需要的过程中。化学信息学是利用信息学的方法来解决化学的问题,得到有关化学本质规律的认识。化学信息学中一个重要的目的是得到一些专家知识来解释所观测到的化学现象。而这些知识往往是隐含在大量的数据中的,这就需要一些思想和方法来挖掘出这些知识。 本论文的研究包含数据库的建立,拓扑描述子的计算,拓扑描述子的结构解释以及QSAR/QSPR中的实际应用等。本文的研究内容分别为: 第一部分提出了直观队列命名法系统(第二章和第三章)。第二章介绍了直观队列命名法的基本原理,利用该方法计算了320多种拓扑指数。第三章建立了中药活性成分数据库,含有4000多种中药活性成分的结构以及相关的生物活性数据。 第二部分是对分子拓扑结构进行描述而得到了不同的描述子(第四章一第七章)。第四章提出了确定分子中心的一种新的方法以及一个新的分子中心指数。第五章从顶点度分布的数学特征出发,以最小的人为干扰来发现分子结构特征,得到了一些很有意思的结果。第六章基于从顶点度分布的数学特征得到的结构特征,提出了一种计算分子分支数目的方法。第七章为了更好地描述所研究的性质,本文提出了一种新的变量策略来获得外部因素变量连接性指数并扩展到高阶来提高回归效果,它们的结果比原先的变量指数以及原先的分子连接性指数要好,该指数是分子连接性指数的一个最新的进展。 第三部分是对一些拓扑指数进行了结构解释(第八章一第十章)。拓扑指数经常面临的一个重要缺点是缺乏用简单的结构和物理化学的概念来进行解释。挖掘出拓扑指数所隐含的结构特征对于解释拓扑指数以及它们所建立的模型都是很有帮助的。第八和九章从这些拓扑指数张成的多维空间里面自动地从高维的点云中找出“有意思的”低维投影。本文作者引入了数论中提出的在多元球面上产生数论网格的TFWW方法,以及利用描述“混乱度”的熵作为投影指标,使用投影寻踪挖掘出了隐含在这些拓扑指数构成的多维空间中的结构特征,来解释了外部因素变量连接性指数,x,Kappa和E-State指数。得到的结果显示拓扑指数之间很可能具有很高的共线性。在第十章从多维的 角度来研究了拓扑指数的相互关系,引入了典型相关分析来发现和定 量化描述两组变量之间的相互关系,并用于了研究x,KapPa以及 E一State指数的相互关系。该研究定量地发现这些拓扑指数之间是高 度线性相关的,而且我们进一步从它们共享的方差分析中发现了它们 为什么是高度相关的。 第四部分是研究如何提取拓扑指数的正交的信息来建立有效的定 量结构活性关系模型(第十一章一第十二章)。为了能在减少变量的同 时也包含原始变量的基本所有信息,第十一章使用了正交块变量的方 法以及典型相关分析来对中药中的活性成分如生物碱进行了结构活性 关研究。第十二章引入了模型的拟合与预测的平衡的观点来选择了块 变量,并用于了色谱保留指数的建模研究。


知网文化
【相似文献】
中国期刊全文数据库 前20条
1 丁波;韩国华;;煤炭企业数据存储方式的设计概念[J];河北能源职业技术学院学报;2006年01期
2 赵志坤;李义杰;;基于粗糙集的分类规则挖掘的研究[J];矿业研究与开发;2006年02期
3 方忠祥;屠航;;基于关联规则的服装销售演示系统设计[J];广西轻工业;2007年05期
4 文晖;;基于SSAS的数据挖掘方案的构建[J];兰州石化职业技术学院学报;2007年03期
5 郭跃斌;翟延富;董祥军;;序列模式的关联规则在彩票分析中的应用研究[J];山东轻工业学院学报(自然科学版);2008年01期
6 费玲玲;张震林;;关联规则挖掘及其在课堂教学评价中的应用[J];成都纺织高等专科学校学报;2009年02期
7 董引娣;;数据挖掘中关联规则在零售业中的应用[J];重庆科技学院学报(自然科学版);2010年01期
8 岳嵘;数据挖掘技术在矿业系统工程中的应用[J];中国矿业;2003年03期
9 邹岚;;基于数据挖掘的远程教育智能答疑系统的设计[J];大连轻工业学院学报;2005年04期
10 王爱霞;;一种模糊关联规则算法[J];武汉工业学院学报;2006年03期
11 何煦春;胡乃联;李国清;;基于数据仓库的矿山企业决策支持系统研究[J];中国矿业;2007年04期
12 康健;;一种某高校网络用户上网形式的数据挖掘方法[J];安徽理工大学学报(自然科学版);2008年03期
13 李兰兰;;搜索引擎个性化信息查询服务[J];武汉科技学院学报;2009年01期
14 李华锋;吴友蓉;;数据挖掘中的预处理技术研究[J];成都纺织高等专科学校学报;2010年02期
15 范晓燕;黄永锋;丛静;潘乔;;基于Web的新生儿可视化数据挖掘分析系统[J];东华大学学报(自然科学版);2010年03期
16 曲萍;;基于改进的自组织特征映射异常数据挖掘算法分析[J];煤炭技术;2010年07期
17 褚丽莉;;基于Java的搜索引擎技术在Web信息挖掘中的应用[J];辽宁工程技术大学学报(自然科学版);2010年05期
18 薛小锋;;数据流挖掘的关键问题研究[J];煤炭技术;2010年12期
19 刘振名;赵可新;刘振亮;;多维数量关联规则聚类挖掘研究[J];煤炭技术;2011年06期
20 李晓瑞,李旻昕,蔺洪利;关联规则挖掘在保险公司客户信息管理中的应用[J];鞍山钢铁学院学报;2002年06期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62982499
  • 010-62783978