收藏本站
收藏 | 手机打开
二维码
手机客户端打开本文

基于时态信息的网页排序系统的研究与实现

钟鸿鹏  
【摘要】: 根据中国互联网络信息中心的互联网分析报告,在中国网络用户获取信息的主要途径中,网络具有最高的比例,占82.6%,高于电视的64.5%和报纸的57.9%。其中,浏览新闻在网民经常使用的网络服务中占首位,比例为66.3%。 时间是信息的本质属性之一,同样也是网页的本质属性之一。在日常生活中,当人们阅读一篇新闻时,总是要把文章的内容和时间信息联系起来,通过文章中的时间信息可以了解一个事件的开始、进行、结束以及事件发生的频率,把握一个事件发生的全过程,了解事件发展的前因后果,作为进一步决策的重要依据。要了解发生的新闻事件,时间信息将是文本中非常关键的因素。 现有的搜索引擎使用关键词匹配的方式查找网页,通常返回很多结果,包含大量冗余信息,用户很难在短时间内准确地筛选出需要的内容,获取有用的信息。主流的基于链接的排序方法倾向于支持较旧的网页,而使新的网页排名靠后。但是大多数用户想要最新的信息,所以带给用户新的网页是非常重要的,而基于时态信息的Web信息搜索方面的研究还非常少。因此,需要对搜索引擎提供的服务加以细化,提供更专业、更有效的服务。 本文对搜索引擎的结果进行二次处理:首先获取前面若干个结果的即时版本,然后对网页文本中的时间信息进行了识别,并针对新闻中可能出现的多个时间,提出了一种基于词共现频率的网页主时间抽取算法,找出最贴切表示网页事件内容的主时间。接着对抽取出的网页主时间进行时间推理转化为规范化的格式;最后根据网页主时间进行搜索结果的排序,将经过这一系列处理后的排序结果返回给用户。


知网文化
【相似文献】
中国期刊全文数据库 前20条
1 胡少荣;孟嗣仪;刘云;张彦超;丁飞;;网页信息自动抽取技术的研究[J];铁路计算机应用;2010年09期
2 钟世通;;C++Builder编程访问网页信息的方法[J];科技资讯;2007年19期
3 徐明;;轻松破解网页右键屏蔽六招[J];电脑校园;2002年12期
4 杜翠茹;;浅析网页布局方法在教学中的优化[J];大众科技;2010年05期
5 孟涛,闫宏飞,王继民;Web网页信息变化的时间局部性规律及其验证[J];情报学报;2005年04期
6 ;和朋友看同一个网页的幸福生活[J];计算机与网络;2005年18期
7 张晓彦;张晓明;;一种基于表格属性的网页信息隐藏算法[J];北京石油化工学院学报;2009年01期
8 郭利伟;王家兵;;Web信息自动标引方法比较[J];内蒙古科技与经济;2009年07期
9 火善栋;;FORM表单反馈网页信息抽取的研究与实现[J];电脑知识与技术;2009年09期
10 张莉,曾致远;Windows下网页信息实时监听程序的设计与实现[J];微计算机信息;2005年03期
11 潘超;梁宏伟;李立召;;基于DOM的网页信息抽取方法[J];硅谷;2010年20期
12 郭清宇;赵冬;;垂直搜索技术在农村综合信息网站设计中的应用[J];中原工学院学报;2007年05期
13 陈琼,苏文健;基于网页结构树的Web信息抽取方法[J];计算机工程;2005年20期
14 于满泉,陈铁睿,许洪波;基于分块的网页信息解析器的研究与设计[J];计算机应用;2005年04期
15 于成龙;;中文网页信息抽取技术及分类算法研究[J];山东理工大学学报(自然科学版);2011年03期
16 xingyunMe;剪剪贴贴~好精彩——网页信息剪贴收集专家eNotebook[J];电脑校园;2003年11期
17 周津,朱明,郑全;基于XML的网页信息自动抽取[J];计算机应用;2004年S1期
18 王少宇,杜娟,秦前清;基于内容的网页信息处理方法[J];计算机应用;2005年04期
19 郝爱峰;;网页结构化信息抽取技术方法研究[J];山西电子技术;2008年04期
20 周庆;;知识管理背景下网页信息档案化管理的思考[J];兰台世界;2011年15期
中国重要会议论文全文数据库 前10条
1 韩近强;赵静;杨冬青;唐世渭;姚小波;;基于领域知识的网页筛选系统[A];第十九届全国数据库学术会议论文集(技术报告篇)[C];2002年
2 王晓峰;刘惟一;;从用户需求到网页集团的模糊变换[A];第二十届全国数据库学术会议论文集(技术报告篇)[C];2003年
3 吴倩;杨逍;张兆心;;基于视觉特征的网页信息提取[A];第六届全国信息检索学术会议论文集[C];2010年
4 罗阳;季铎;张桂平;王莹莹;;面向单一网页的双语资源挖掘方法[A];第六届全国信息检索学术会议论文集[C];2010年
5 张贯虹;乌达巴拉;巩政;;基于向量空间模型的网页文本句子对齐方法研究[A];第十一届全国人机语音通讯学术会议论文集(一)[C];2011年
6 何庆;汤庸;谭柱成;;时态信息处理试验平台的构建[A];第二十二届中国数据库学术会议论文集(研究报告篇)[C];2005年
7 赵玉芳;张一鸣;;基于网页信息的印象形成的初步研究[A];第十届全国心理学学术大会论文摘要集[C];2005年
8 张阳;李战怀;近藤广幸;;WEB PAGE的自动分类[A];第十六届全国数据库学术会议论文集[C];1999年
9 戴玉刚;;藏文网页采集技术研究[A];民族语言文字信息技术研究——第十一届全国民族语言文字信息学术研讨会论文集[C];2007年
10 王文生;谢能付;;基于Web的农业信息自动抽取方法研究[A];中国农业信息科技创新与学科发展大会论文汇编[C];2007年
中国博士学位论文全文数据库 前10条
1 焦斌星;用于搜索的网页可视化摘要技术研究[D];中国科学技术大学;2012年
2 刘守群;海量网络视频快速检索关键技术研究[D];中国科学技术大学;2010年
3 孟宪军;互联网文本聚类与检索技术研究[D];哈尔滨工业大学;2009年
4 张长利;面向特定领域的互联网舆情分析技术研究[D];吉林大学;2011年
5 曹鲁慧;Web个人信息集成问题研究[D];山东大学;2012年
6 黄河;农业复杂自适应搜索模型研究及实现[D];中国科学技术大学;2010年
7 王镠璞;基于用户体验的互联网搜索引擎医学信息检索可用性评估研究[D];吉林大学;2010年
8 段瑞雪;基于依存关系的用户意图的研究[D];北京邮电大学;2011年
9 刘娜;文本自动摘要和信息抽取方法及其应用研究[D];大连海事大学;2012年
10 王肃;基于多Agent的突发事件信息智能监测系统研究[D];北京邮电大学;2011年
中国硕士学位论文全文数据库 前10条
1 钟鸿鹏;基于时态信息的网页排序系统的研究与实现[D];华南理工大学;2010年
2 于洪波;中文网页自动采集与分类系统设计与实现[D];北京邮电大学;2010年
3 张航;主题爬虫的实现及其关键技术研究[D];武汉理工大学;2010年
4 冯明远;深度网络信息爬取关键技术研究与实现[D];浙江大学;2010年
5 邓科;智能搜索中的中文网页分类研究[D];兰州理工大学;2011年
6 党春辉;网页消重和聚类算法在高校搜索引擎中的研究与应用[D];东华大学;2010年
7 马伟瑜;基于改进的PageRank的网页信息可信度评估方法研究[D];河北大学;2011年
8 任斌;基于本体的主动学习主题爬行的研究与实现[D];吉林大学;2010年
9 任兰鹏;基于代表样本的中文网页分类研究[D];山东大学;2010年
10 王立建;中文web文本过滤技术研究[D];中北大学;2010年
中国重要报纸全文数据库 前10条
1 壮壮;批量保存网页信息[N];电脑报;2004年
2 东方早报记者 李伟;要名还是要利,这是个问题[N];东方早报;2011年
3 任一鸣;垂直搜索:抓住细分需求[N];计算机世界;2007年
4 金山软件副总裁 杨桓;着力“三大系统” 构筑网络安全屏障[N];中国电子报;2009年
5 郭京霞;枫叶之都状告百度恶意排名一审败诉[N];中国知识产权报;2007年
6 路人甲;请个专家来贴图[N];电脑报;2005年
7 夏凌;搜索引擎排名纠纷百度胜出[N];中华工商时报;2007年
8 钱鹏;网尽Web页中的好东东[N];电脑报;2004年
9 郭京霞;百度胜诉搜索引擎排名纠纷案[N];中国企业报;2007年
10 章森 王伟;搜索引擎的工作机制[N];计算机世界;2006年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62982499
  • 010-62783978