主题爬虫研究进展
[Abstract]:With the rapid development of Internet technology, the number of web pages has increased dramatically, the status of search engines has become irreplaceable, and has become the entry point for people to use Internet. As the information source of search engine, web spider is an essential part of search engine. The key technology of web spider design is introduced. In addition, with the increasing demand for personalized users and the rapid increase in the number of web pages, the general search engine can not meet the needs of specific users, professional search engines have been rapidly developed. At the same time, there has been a great breakthrough and progress in the research of topic reptiles. Subject reptiles are different from common crawlers, which emphasize the integrity of crawling, while themed reptiles emphasize the relevance of web pages to specific topics. At the same time, the research status of the subject reptile is introduced and summarized.
【作者单位】: 四川大学计算机学院;
【分类号】:TP391.3;TP393.092
【参考文献】
相关期刊论文 前1条
1 刘畅;;综合搜索引擎与垂直搜索引擎的比较研究[J];情报科学;2007年01期
【共引文献】
相关期刊论文 前10条
1 祝伟华;李嘉毅;刘斌斌;;二手汽车交易信息垂直搜索网的设计[J];重庆工学院学报(自然科学版);2008年08期
2 赵洋;滕桂法;张玉新;何冬梅;;基于Internet的农业信息垂直搜索引擎的设计[J];河北农业大学学报;2009年06期
3 毕建涛;霍云福;;垂直搜索引擎赢利模式探讨[J];大连大学学报;2008年03期
4 陈洪猛;;基于垂直搜索技术的搜索引擎解决方案[J];电脑应用技术;2008年01期
5 刘金亮;吴芳;孟海江;;智能化垂直搜索系统的构建[J];电脑知识与技术;2010年02期
6 黄轩;;辛亥革命史主题爬虫的设计与实现[J];电脑知识与技术;2011年13期
7 王春晖;吴麒;朱锴;;基于特征选择优化的主题描述算法[J];计算机光盘软件与应用;2012年01期
8 县小平;;主题搜索引擎的PageRank算法研究[J];甘肃高师学报;2011年05期
9 王树文;郑阔实;陈竟博;;面向教育主题的垂直搜索引擎的设计与实现[J];长春师范学院学报;2013年04期
10 康亚娟;;站内搜索的研究与实现[J];信息技术;2011年08期
相关会议论文 前1条
1 陈竹敏;马军;韩晓晖;雷景生;;面向主题爬取的多粒度URLs优先级计算方法[A];第四届全国信息检索与内容安全学术会议论文集(上)[C];2008年
相关博士学位论文 前9条
1 吴羽;面向时间敏感对象的垂直搜索引擎关键技术研究[D];浙江大学;2011年
2 李群;主题搜索引擎聚类算法的研究[D];北京林业大学;2011年
3 寇月;Deep Web实体搜索的关键技术研究[D];东北大学;2009年
4 彭涛;面向专业搜索引擎的主题爬行技术研究[D];吉林大学;2007年
5 陈竹敏;面向垂直搜索引擎的主题爬行技术研究[D];山东大学;2008年
6 管子玉;基于图学习的Web信息检索技术研究[D];浙江大学;2010年
7 赵洁;面向Web的企业竞争情报获取研究[D];中国科学技术大学;2013年
8 汲业;面向图像的垂直搜索引擎关键技术研究[D];大连海事大学;2013年
9 李雁妮;深网数据集成与挖掘关键问题的建模及算法研究[D];西安电子科技大学;2013年
相关硕士学位论文 前10条
1 吕芳芳;基于查询扩展的垂直搜索研究[D];山东科技大学;2010年
2 檀康;基于深度网页爬虫搜索引擎原型的研究和实现[D];东华大学;2010年
3 卢承山;基于领域的主题信息采集技术研究[D];武汉理工大学;2011年
4 邱伟林;面向领域的垂直搜索引擎的研究与实现[D];大连海事大学;2011年
5 文星;基于位置感知的Web文本搜索技术研究[D];大连海事大学;2011年
6 周兵;基于分布式精准采集的垂直搜索引擎的研究与实现[D];北京邮电大学;2011年
7 刘欢;职位匹配系统的设计与实现[D];华东师范大学;2011年
8 郭艳芬;林业主题搜索引擎的设计与实现[D];北京林业大学;2011年
9 刘志伟;数学搜索引擎研究[D];兰州大学;2011年
10 赵思佳;基于规则引擎的个性化网页爬虫研究[D];中南大学;2010年
【二级参考文献】
相关期刊论文 前4条
1 黄建莲;中国搜索引擎服务市场的现状及发展[J];华北科技学院学报;2005年03期
2 郝凤英;垂直网站及其信息服务模式[J];情报理论与实践;2002年02期
3 肖冬梅;垂直搜索引擎研究[J];图书馆学研究;2003年02期
4 陈新颜;垂直搜索引擎辨析[J];现代情报;2004年09期
【相似文献】
相关期刊论文 前10条
1 陈晨;;基于主题爬虫的个性化搜索引擎技术研究[J];黑龙江科技信息;2010年31期
2 赵思佳;尹婷;;基于规则引擎的个性化主题网页爬虫的研究[J];计算机技术与发展;2011年03期
3 秦学勇;;基于互联网资源的学科Ontology构建研究[J];廊坊师范学院学报(自然科学版);2011年02期
4 汪斌;张云伟;刘健;陈晶;;一种面向农业信息主题网络爬虫的设计[J];安徽农业科学;2009年20期
5 高灵霞;;基于主题爬虫的个性化搜索引擎技术分析[J];电脑知识与技术;2009年32期
6 何毅;;建筑院校主题搜索引擎设计与实现[J];吉林建筑工程学院学报;2010年05期
7 刘国靖;康丽;罗长寿;;基于遗传算法的主题爬虫策略[J];计算机应用;2007年S2期
8 徐诗亮;;一种基于概念空间的主题爬虫设计方法[J];福建电脑;2008年10期
9 任辉;;基于关键词的生物主题爬虫设计[J];图书情报工作;2009年09期
10 池勇敏;郝泳涛;;分布式主题爬虫的设计与实现[J];计算机应用与软件;2010年12期
相关会议论文 前10条
1 彭轲;廖闻剑;;浅析搜索引擎[A];中国通信学会第五届学术年会论文集[C];2008年
2 李丹;;如何利用搜索引擎查找中医药信息[A];中国中医药信息研究会第二届理事大会暨学术交流会议论文汇编[C];2003年
3 邓长寿;郭景峰;杨焱林;邓安远;;下一代Web搜索引擎初探[A];第十八届全国数据库学术会议论文集(研究报告篇)[C];2001年
4 维尼拉·木沙江;吐尔洪·吾司曼;;维、哈、柯文搜索引擎中网页爬行器的设计与实现[A];少数民族青年自然语言处理技术研究与进展——第三届全国少数民族青年自然语言信息处理、第二届全国多语言知识库建设联合学术研讨会论文集[C];2010年
5 汤薇;曾艳;;构建校园网搜索引擎必要性分析[A];广西计算机学会2008年年会论文集[C];2008年
6 姚树宇;赵少东;;一种使用分布式技术的搜索引擎[A];2005年全国开放式分布与并行计算学术会议论文集[C];2005年
7 倪俊峰;;基于黄页搜索引擎的关键字排名广告系统的设计与实现[A];2005年中国索引学会年会暨学术研讨会论文集[C];2005年
8 张怡;查贵庭;;SEO在信息服务中的应用研究[A];2010年中国索引学会年会暨学术研讨会论文集[C];2010年
9 陈援非;何哲;朱珍民;;基于普适计算的个性化搜索技术[A];第二届和谐人机环境联合学术会议(HHME2006)——第2届中国普适计算学术会议(PCC'06)论文集[C];2006年
10 杨萌;李春丽;朱明;;网络搜索技术下的编辑工作[A];学报编辑论丛(第十一集)[C];2003年
相关重要报纸文章 前10条
1 李一鑫;搜索排名的红与黑[N];财经时报;2007年
2 周文林;搜狗3.0能否撼动搜索市场[N];经济参考报;2007年
3 惠正一;比尔·盖茨:微软不怕Google[N];第一财经日报;2005年
4 赛迪顾问股份有限公司互联网与电子商务咨询中心 常燕杰;搜索,,还是门户[N];中国计算机报;2005年
5 陈珊;浙江移动推出手机搜索引擎服务[N];人民邮电;2005年
6 赵法忠;搜索引擎还需悠着点[N];中国经营报;2005年
7 金朝力;搜索引擎火拼搜索质量[N];北京商报;2006年
8 本报记者 赵晓辉 孟昭丽;搜索引擎驶入“避风港”[N];中国证券报;2006年
9 孙t;搜索引擎惊喜侵权官司止于“避风港”?[N];第一财经日报;2006年
10 姜蕊;问天下谁识搜索?[N];中国高新技术产业导报;2006年
相关博士学位论文 前10条
1 岑荣伟;基于用户行为分析的搜索引擎评价研究[D];清华大学;2010年
2 李群;主题搜索引擎聚类算法的研究[D];北京林业大学;2011年
3 苏君华;面向搜索引擎的技术接受模型研究[D];南京大学;2011年
4 刘佐达;分布协作式搜索引擎模型及算法研究[D];清华大学;2011年
5 陈旭毅;基于索引云的企业搜索引擎实现研究[D];武汉大学;2011年
6 郭眈;中文互联网视频搜索引擎系统策略研究[D];北京交通大学;2012年
7 王昤璞;基于用户体验的互联网搜索引擎医学信息检索可用性评估研究[D];吉林大学;2010年
8 李莎莎;面向搜索引擎的自然语言处理关键技术研究[D];国防科学技术大学;2011年
9 郑文良;基于简单本体的农业P2P搜索引擎关键技术研究[D];沈阳农业大学;2013年
10 白玉琪;空间信息搜索引擎研究[D];中国科学院研究生院(遥感应用研究所);2003年
相关硕士学位论文 前10条
1 温泉;基于聚焦相关度排序的搜索引擎研究与应用[D];东华大学;2010年
2 薛云;Internet上元搜索引擎的研究与设计[D];太原理工大学;2003年
3 王春花;基于Nutch的农业搜索引擎检索结果排序策略的研究[D];西北农林科技大学;2010年
4 李雷;基于Nutch的农业信息搜索引擎实现和优化[D];吉林大学;2011年
5 董晨;基于模糊聚类的个性化搜索引擎的研究[D];福州大学;2005年
6 封俊;基于Hadoop的分布式搜索引擎研究与实现[D];太原理工大学;2010年
7 李浩;分布式教育网信息检索系统的研究和实现[D];华南理工大学;2010年
8 尉建兴;基于Lucene搜索引擎的研究与应用[D];太原理工大学;2011年
9 李建平;智能化WEB信息搜索引擎的研究与实现[D];大庆石油学院;2003年
10 田生伟;基于涉农词典的搜索引擎的研究与实践[D];新疆大学;2004年
本文编号:2400573
本文链接:https://www.wllwen.com/kejilunwen/sousuoyinqinglunwen/2400573.html