中国科学院机构知识库网格
Chinese Academy of Sciences Institutional Repositories Grid
基于Context Graphs的主题爬虫的研究与实现

文献类型:期刊论文

作者陈星
刊名计算机工程与设计
出版日期2011
期号3页码:914-917
关键词主题爬虫 Context Graphs模型 层次建模 链接分析 内容分析
中文摘要为了解决传统主题爬虫对主题网页搜索效率偏低的问题,分析了基于网络拓扑结构建模的Context Graphs的爬行策略。考虑了以往ContextGraphs方法存在的不足,即没有区分网页不同部分文本的重要程度,通过将锚文字、页面标题和页面内容做综合考虑,对原算法进行了改进。将改进前后的算法进行实验对比,实验结果表明,在提高主题爬行质量方面,改进后的算法达到了更好的效果。
收录类别cnki
公开日期2011-10-10
源URL[http://124.16.136.157/handle/311060/13935]  
专题软件研究所_软件所图书馆_期刊论文
推荐引用方式
GB/T 7714
陈星. 基于Context Graphs的主题爬虫的研究与实现[J]. 计算机工程与设计,2011(3):914-917.
APA 陈星.(2011).基于Context Graphs的主题爬虫的研究与实现.计算机工程与设计(3),914-917.
MLA 陈星."基于Context Graphs的主题爬虫的研究与实现".计算机工程与设计 .3(2011):914-917.

入库方式: OAI收割

来源:软件研究所

浏览0
下载0
收藏0
其他版本

除非特别说明,本系统中所有内容都受版权保护,并保留所有权利。