基于Context Graphs的主题爬虫的研究与实现
文献类型:期刊论文
作者 | 陈星 |
刊名 | 计算机工程与设计
![]() |
出版日期 | 2011 |
期号 | 3页码:914-917 |
关键词 | 主题爬虫 Context Graphs模型 层次建模 链接分析 内容分析 |
中文摘要 | 为了解决传统主题爬虫对主题网页搜索效率偏低的问题,分析了基于网络拓扑结构建模的Context Graphs的爬行策略。考虑了以往ContextGraphs方法存在的不足,即没有区分网页不同部分文本的重要程度,通过将锚文字、页面标题和页面内容做综合考虑,对原算法进行了改进。将改进前后的算法进行实验对比,实验结果表明,在提高主题爬行质量方面,改进后的算法达到了更好的效果。 |
收录类别 | cnki |
公开日期 | 2011-10-10 |
源URL | [http://124.16.136.157/handle/311060/13935] ![]() |
专题 | 软件研究所_软件所图书馆_期刊论文 |
推荐引用方式 GB/T 7714 | 陈星. 基于Context Graphs的主题爬虫的研究与实现[J]. 计算机工程与设计,2011(3):914-917. |
APA | 陈星.(2011).基于Context Graphs的主题爬虫的研究与实现.计算机工程与设计(3),914-917. |
MLA | 陈星."基于Context Graphs的主题爬虫的研究与实现".计算机工程与设计 .3(2011):914-917. |
入库方式: OAI收割
来源:软件研究所
浏览0
下载0
收藏0
其他版本
除非特别说明,本系统中所有内容都受版权保护,并保留所有权利。