收藏本站
《广东工业大学》 2011年
收藏 | 手机打开
二维码
手机客户端打开本文

基于社保的数据关联处理方法

万少飞  
【摘要】:数据挖掘是数据库或数据创库技术发展到一定程度的产物,使用数据挖掘的目的是利用有效的算法,从海量的数据中挖掘或发现我们未知,并且有价值的信息,最终用简单的方法展现出来。目前数据挖掘的技术已经应用到商业销售,投资市场,建筑工业等多个领域,但是在社保领域方面还处在初级阶段。 本文以关联规则的挖掘作为理论基础,通过实际应用系统的需求分析,结合社保数据自身的特点,挖掘出了社保数据中蕴含的属性与属性、事务与事务之间的关联,说明了将数据挖掘技术应用到社保数据分析中的重要性和实际意义。其次,对数据挖掘的相关概念、主要任务、过程跟方法、发展现状和发展趋势作了比较详细的阐述.本文以佛山社保信息系统的建设为背景,以系统运行的过程中大量的社保数据作为基础进行数据挖掘技术的探索和研究,并通过相关文献的分析和对比,在数据挖掘、数据仓库、数据关联等知识的基础上,针对大量的社保数据关联规则的挖掘进行了探索性的分析。阐述关联规则的相关概念和问题,设计和实现了关联规则发现算法,依据系统的实际应用和社保数据的特点,在Apriori算法的基础上提出了挖掘社保数据关联规则。使用了加权参数来加强重要社保开户类型的重要性,以挖据出开户时间、开户类型、医疗费用之间的关系。使用本算法挖掘出的关联规则有比较高的应用价值,能帮助医保决策人员在正确的时间有重点的开展医保业务,提高工作效率和收益。 最后,在对序列模式的基础知识有了全面的理解之后,然后对常用的序列模式发现算法进行了比较细致的分析和比较,在此基础上,本文也对发现社保数据中的序列模式的问题进行了创造性的开发和研究,并提出了发现社保数据序列模式需要解决的几个问题,主要有:数据量大;分析对象不固定;序列的长度较长;属性之间重要性不同.针对这几个问题,本文在PrefixSpan算法的基础之上提出了算法的改进方法:使用数据划分,减少数据量,建设通用平台,根据应用的实际需求来确定分析的对象,从而发现不同类型的序列模式;通过使用记录的前缀来大大的缩短待分析的序列的长度;并且在扫描投影数据库的过程中引入“加权前缀’方法的思想来强调属性的重要性,使大型商户类型投保出现在发现的频繁序列之中,以分析其发生规律在大量时序数据中挖掘出社保数据潜在的序列模式,有利于社保预测和社保部门前期计划,对合理安排工作,提高社保部门反应速度和处理能力都有重大意义.
【学位授予单位】:广东工业大学
【学位级别】:硕士
【学位授予年份】:2011
【分类号】:TP311.13

手机知网App
【引证文献】
中国硕士学位论文全文数据库 前2条
1 张玉东;PG炼钢厂MES系统数据挖掘的设计与开发[D];电子科技大学;2011年
2 李永祥;基于OLAP的电力客户能效评估方法及应用[D];兰州理工大学;2012年
【参考文献】
中国期刊全文数据库 前5条
1 张坤;朱扬勇;;无重复投影数据库扫描的序列模式挖掘算法[J];计算机研究与发展;2007年01期
2 吕静,王晓峰,Osei Adjei,Fiaz Hussain;序列模式图及其构造算法[J];计算机学报;2004年06期
3 梁世红;数据挖掘在CRM中的应用[J];科技情报开发与经济;2003年01期
4 陈安龙,唐常杰,陶宏才,元昌安,谢方军;基于极大团和FP-Tree的挖掘关联规则的改进算法[J];软件学报;2004年08期
5 李卫华;刘卫国;;一种基于压缩矩阵的Apriori改进算法[J];计算机系统应用;2008年03期
中国硕士学位论文全文数据库 前2条
1 蒋力;基于关联规则的数据挖掘算法及其应用[D];中南大学;2007年
2 孙兴中;警情数据的关联规则与序列模式发现[D];北京交通大学;2009年
【共引文献】
中国期刊全文数据库 前10条
1 马帅,唐世渭,杨冬青,王腾蛟,高军;移动环境中的最大移动序列模式挖掘(英文)[J];北京大学学报(自然科学版);2004年03期
2 徐前方;肖波;郭军;;一种基于相关度统计的告警关联规则挖掘算法[J];北京邮电大学学报;2007年01期
3 周涛;;关联规则算法综述[J];才智;2011年16期
4 秦晓薇;刘燕;;序列模式挖掘算法的分析[J];赤峰学院学报(自然科学版);2012年01期
5 邢容;;序列模式图可视化算法的研究与实现[J];中国城市经济;2010年10期
6 黄金;;基于频繁模式的蛋白质序列分类[J];东北农业大学学报;2008年05期
7 任家东;宗俊省;;一种基于规则表达式约束的序列模式增量式挖掘算法[J];燕山大学学报;2007年05期
8 任家东;周晓磊;;一种挖掘序列模式的增量式更新算法[J];燕山大学学报;2007年06期
9 龚振志;胡孔法;达庆利;张长海;;DMGSP:一种快速分布式全局序列模式挖掘算法[J];东南大学学报(自然科学版);2007年04期
10 胡孔法;张长海;陈崚;达庆利;;一种面向物流数据分析的路径序列挖掘算法ImGSP[J];东南大学学报(自然科学版);2008年06期
中国重要会议论文全文数据库 前10条
1 姚伟力;王锡禄;宋俊德;;基于序列模式挖掘的告警相关性分析算法[A];2005年信息与通信领域博士后学术会议论文集[C];2005年
2 潘瑾;严勇;王晨;方晨;汪卫;施伯乐;;Chopper:一个高效的有序标号树频繁结构的挖掘算法[A];第二十届全国数据库学术会议论文集(研究报告篇)[C];2003年
3 吴先荣;杨冬青;唐世渭;王腾蛟;;基于序列树的告警相关性分析[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
4 吕静;陈未如;刘俊;Osei Adjei;;并发分支模式挖掘[A];第二十一届中国数据库学术会议论文集(技术报告篇)[C];2004年
5 吴铁峰;彭宏;张东娜;;一种网络告警的增量挖掘算法[A];第二十一届中国数据库学术会议论文集(技术报告篇)[C];2004年
6 朱永泰;王晨;洪铭胜;汪卫;施伯乐;;ESPM——频繁子树挖掘算法[A];第二十一届中国数据库学术会议论文集(研究报告篇)[C];2004年
7 牛兴雯;杨冬青;唐世渭;王腾蛟;;OSAF-tree——可迭代的移动序列模式挖掘及增量更新方法[A];第二十一届中国数据库学术会议论文集(研究报告篇)[C];2004年
8 程银波;司菁菁;;带有间隔约束的序列模式挖掘算法[A];第二十二届中国数据库学术会议论文集(技术报告篇)[C];2005年
9 张锐;熊赟;陈越;朱扬勇;;MS-BioSM:一个基于多支持度生物序列模式挖掘算法[A];第二十四届中国数据库学术会议论文集(技术报告篇)[C];2007年
10 郭黎敏;丁治明;胡泽林;陈超;;基于路网的不确定性轨迹预测[A];第26届中国数据库学术会议论文集(A辑)[C];2009年
中国博士学位论文全文数据库 前10条
1 叶红云;面向金融营销问题的个性化推荐方法研究[D];合肥工业大学;2011年
2 朱辉生;基于情节规则匹配的数据流预测研究[D];复旦大学;2011年
3 林冠洲;网络流量识别关键技术研究[D];北京邮电大学;2011年
4 刘维;生物序列模式挖掘与识别算法的研究[D];南京航空航天大学;2010年
5 杨钤雯;序列模式挖掘方法及Web使用挖掘研究[D];天津大学;2010年
6 佘春东;数据挖掘算法分析及其并行模式研究[D];电子科技大学;2004年
7 宋艳;CRM中基于CABOSFV改进算法的客户聚类研究[D];哈尔滨工程大学;2004年
8 王占全;基于地理信息系统空间数据挖掘若干关键技术的研究[D];浙江大学;2005年
9 马海兵;频繁模式挖掘相关技术研究[D];复旦大学;2005年
10 宋世杰;基于序列模式挖掘的误用入侵检测系统及其关键技术研究[D];国防科学技术大学;2005年
中国硕士学位论文全文数据库 前10条
1 任芳;时间序列数据挖掘研究[D];辽宁师范大学;2010年
2 况莉莉;关联规则在高校图书馆读者数据处理中的应用研究[D];合肥工业大学;2010年
3 陈晶;基于序列模式挖掘算法的入侵检测研究[D];华东师范大学;2011年
4 丁大伟;电子交易中软件运行时行为分析与预测[D];湖南工业大学;2010年
5 白霜;DNA序列的最大频繁模式挖掘[D];南昌大学;2010年
6 江兵;重庆耐德客户关系管理系统的设计与实现[D];电子科技大学;2010年
7 徐海兰;Web日志挖掘技术在个性化信息推荐中的应用[D];延边大学;2009年
8 严兆斌;序列模式挖掘在公路隧道交通中的应用研究[D];西安电子科技大学;2009年
9 李瑞华;数据挖掘在煤矿安全监测中的应用[D];西安电子科技大学;2010年
10 赵琦元;商业银行零售客户的交叉销售策略研究[D];西安工业大学;2011年
【同被引文献】
中国期刊全文数据库 前10条
1 王庆一;中国的能源效率及国际比较(下)[J];节能与环保;2003年09期
2 刘新才;曾鸣;黄琰;;基于层次分析法的电力客户信用风险评价[J];电力需求侧管理;2005年06期
3 任慧;王坚;;能效评估系统的应用研究[J];电脑知识与技术;2008年29期
4 李翔,杨淑霞,张红斌;供电服务质量评价方法研究[J];电网技术;2004年12期
5 周黎莎;于新华;;基于网络层次分析法的电力客户满意度模糊综合评价[J];电网技术;2009年17期
6 杨克俭,丁学钧;数据挖掘及其应用研究回顾[J];福建电脑;2004年07期
7 李江;卢毅勤;;电力客户信用等级评价体系构建研究[J];华北电力大学学报(社会科学版);2007年04期
8 吴剑飞;姚建刚;陈华林;龚陈雄;李昀;;电力客户能效状态模糊综合评估[J];电力系统保护与控制;2010年13期
9 张宝,吴方根;电厂热力系统节能分析方法的现状与展望[J];节能;2004年06期
10 邓英,李明;Web数据挖掘技术及工具研究[J];计算机工程与应用;2001年20期
中国硕士学位论文全文数据库 前6条
1 张大德;攀钢提钒炼钢厂企业管理信息系统的总体设计与实施[D];重庆大学;2001年
2 郭春梅;互联网环境下电子商务数据仓库技术的研究[D];北方工业大学;2003年
3 王娟;数据仓库开发探索以及在社保领域的应用[D];电子科技大学;2005年
4 旷海兰;基于粗糙集理论的数据挖掘算法研究[D];长沙理工大学;2006年
5 唐笑林;数据挖掘在高职教学中的应用[D];安徽大学;2006年
6 何学武;数据挖掘技术及其在高校数字化图书馆管理中的应用研究[D];中南大学;2008年
【二级引证文献】
中国硕士学位论文全文数据库 前1条
1 刘伟;新能源风力发电特性的研究及数据分析系统的设计[D];华北电力大学;2013年
【二级参考文献】
中国期刊全文数据库 前10条
1 张坤;朱扬勇;;无重复投影数据库扫描的序列模式挖掘算法[J];计算机研究与发展;2007年01期
2 陆楠,王喆,周春光;基于FP-tree频集模式的FP-Growth算法对关联规则挖掘的影响[J];吉林大学学报(理学版);2003年02期
3 欧阳军,马稳,沈钧毅,史保怀;广义关联规则及算法研究[J];计算机工程与应用;2002年20期
4 黄解军,潘和平,万幼川;数据挖掘技术的应用研究[J];计算机工程与应用;2003年02期
5 晏明春;谢辉;;基于绩效管理的最大频繁模式挖掘研究[J];计算机工程与应用;2006年05期
6 谈克林;孙志挥;;一种FP树的并行挖掘算法[J];计算机工程与应用;2006年13期
7 刘明吉;王秀峰;黄亚楼;;数据挖掘中的数据预处理[J];计算机科学;2000年04期
8 欧阳为民;郑诚;张燕;;国际知识发现与数据发掘工具评述[J];计算机科学;2001年03期
9 阎星娥;鞠时光;蔡涛;辛燕;;OLAP中基于FP-增长的关联规则挖掘[J];计算机科学;2004年04期
10 于卫红;用VB对基于Apriori算法的数据挖掘的实现[J];计算机工程;2004年02期
中国硕士学位论文全文数据库 前2条
1 贾俊杰;基于关联规则的数据挖掘算法研究[D];西北师范大学;2005年
2 许军;基于公安信息的数据挖掘应用研究[D];南京工业大学;2006年
【相似文献】
中国期刊全文数据库 前10条
1 丁纪云,蔡春娥;利用构造数据集评定数据挖掘过程的方法[J];湖南广播电视大学学报;2001年02期
2 任承业,罗伟其;校园信息系统中CRM与数据挖掘的结合和应用[J];计算机工程与应用;2003年13期
3 王艳;数据挖掘在数字图书馆中的应用[J];情报科学;2003年02期
4 邵红全,赵茜;用SQL Server2000实现数据挖掘的技术与策略[J];电脑开发与应用;2003年04期
5 耿庆鹏,卢子芳;利用数据挖掘技术实现对电信行业用户欺诈行为的预测[J];电信快报;2003年10期
6 蒋良孝,蔡之华;基于数据仓库的数据挖掘研究[J];计算技术与自动化;2003年03期
7 叶静,蔡之华;遥感图像中的数据挖掘应用概述[J];计算机与现代化;2003年10期
8 黄解军,万幼川,潘和平;银行客户关系管理与数据挖掘的应用[J];计算机工程与设计;2003年07期
9 崔强,朱卫东;基于数据挖掘的铁路机务段成本控制系统[J];铁路计算机应用;2003年01期
10 杨思春;基于数据仓库的数据挖掘技术分析研究[J];微机发展;2003年09期
中国重要会议论文全文数据库 前10条
1 郭学军;陈晓云;;粗集方法在数据挖掘中的应用[A];第十六届全国数据库学术会议论文集[C];1999年
2 徐慧;;基于Web的文献数据挖掘[A];第十七届全国数据库学术会议论文集(技术报告篇)[C];2000年
3 孙迎;;医院信息的数据挖掘与方法研究[A];中华医学会第十次全国医学信息学术会议论文汇编[C];2004年
4 薛晓东;李海玲;;数据挖掘的客户关系管理应用[A];科技、工程与经济社会协调发展——河南省第四届青年学术年会论文集(下册)[C];2004年
5 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病“阴阳类证”辨证规范的数据挖掘研究[A];中华医学会第十三次全国神经病学学术会议论文汇编[C];2010年
6 薛鲁华;张楠;;聚类分析在Web数据挖掘中的应用[A];北京市第十三次统计科学讨论会论文选编[C];2006年
7 朱扬勇;黄超;;基于多维模型的交互式数据挖掘框架[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
8 陈涛;胡学钢;陈秀美;;基于数据挖掘的教学质量评价体系分析[A];全国第21届计算机技术与应用学术会议(CACIS·2010)暨全国第2届安全关键技术与应用学术会议论文集[C];2010年
9 王星;谢邦昌;戴稳胜;;数据挖掘在保险业中的应用[A];北京市第十二次统计科学讨论会论文选编[C];2003年
10 郭建文;黄燕;印鉴;杨小波;梁兆辉;;建立中风病阴阳类证辨证规范的数据挖掘研究[A];2010中国医师协会中西医结合医师大会摘要集[C];2010年
中国重要报纸全文数据库 前10条
1 李开宇 黄建军 田长春;把“数据挖掘”作用发挥出来[N];中国国防报;2009年
2 华莱士;“数据挖掘”让银行赢利更多[N];国际金融报;2003年
3 记者 晏燕;数据挖掘让决策者告别“拍脑袋”[N];科技日报;2006年
4 □中国电信股份有限公司北京研究院 张舒博 □北京邮电大学计算机科学与技术学院 牛琨;走出数据挖掘的误区[N];人民邮电;2006年
5 张立明;数据挖掘之道[N];网络世界;2003年
6 中圣信息技术有限公司 李辉;数据挖掘在CRM中的作用[N];中国计算机报;2001年
7 田红生;数据挖掘在CRM中的应用[N];中国经济时报;2002年
8 王广宇;数据挖掘 加速银行CRM一体化[N];中国计算机报;2004年
9 周蓉蓉;数据挖掘需要点想像力[N];计算机世界;2004年
10 张舒博;数据挖掘 提升品牌的好帮手[N];首都建设报;2009年
中国博士学位论文全文数据库 前10条
1 孙丽;工艺知识管理及其若干关键技术研究[D];大连交通大学;2005年
2 胡志坤;复杂有色金属熔炼过程操作模式智能优化方法研究[D];中南大学;2005年
3 刘革平;基于数据挖掘的远程学习评价研究[D];西南师范大学;2005年
4 刘寨华;基于临床数据分析的病毒性心肌炎证候演变规律研究[D];黑龙江中医药大学;2006年
5 王川;基因芯片数据管理及数据挖掘[D];中国科学院研究生院(上海生命科学研究院);2004年
6 王涛;挖掘序列模式和结构化模式的精简集[D];华中科技大学;2006年
7 郭斯羽;动态数据中的数据挖掘研究[D];浙江大学;2002年
8 李旭升;贝叶斯网络分类模型研究及其在信用评估中的应用[D];西南交通大学;2007年
9 刘东升;面向连锁零售企业的客户关系管理模型(R-CRM)研究[D];浙江工商大学;2008年
10 余红;网络时政论坛舆论领袖研究[D];华中科技大学;2007年
中国硕士学位论文全文数据库 前10条
1 廖赛恩;养生方数据挖掘分析系统的研制[D];湖南中医药大学;2010年
2 李坤然;数据挖掘在股市趋势预测的应用研究[D];中南林业科技大学;2008年
3 郑宏;数据挖掘可视化技术的研究与实现[D];西安电子科技大学;2010年
4 杜金刚;数据挖掘在电信客户关系管理及数据业务营销中的应用[D];北京邮电大学;2010年
5 徐路;基于决策树的数据挖掘算法的研究及其在实际中的应用[D];电子科技大学;2009年
6 梁小鸥;数据挖掘在高职教学管理中的应用[D];华南理工大学;2011年
7 王浩;数据挖掘在上海市职业能力考试院招录考试优化管理项目中的运用研究[D];华东理工大学;2012年
8 黎卫英;数据挖掘在中职幼教课程改革中的应用[D];福建师范大学;2009年
9 张煜辉;数据挖掘和SPC在生产过程质量控制中应用研究[D];上海交通大学;2009年
10 刘华敏;数据挖掘在高职院校学生成绩分析中的应用[D];安徽大学;2011年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026