基于JavaScript切片的AJAX框架网络爬虫技术研究
文献类型:期刊论文
刊名 | 计算机系统应用
![]() |
出版日期 | 2009 |
卷号 | 018 |
关键词 | JavaScript 程序切片 网络爬虫 有限状态机 AJAX |
ISSN号 | 1003-3254 |
其他题名 | Web Crawler Technology of AJAX Frame Based on JavaScript Slicing |
英文摘要 | 自Jesse James Garrett提出了AJAX概念以来,由于AJAX在提升用户交互体验的同时,又不需要在客户端安装插件。因此,一经提出就引起了互联网领域的广泛关注。但目前的网络爬虫技术在AJAX框架的URL解析过程中存在着不能够识别事件触发顺序等问题,导致大量数据不能被搜索引擎有效检索。本文针对此问题,通过研究基于对象的程序切片算法,以及脚本执行引擎与切片模块的互操作,最终解决AJAX框架中URL提取以及异步JavaScript网络爬虫系统的关键技术问题。 |
语种 | 中文 |
CSCD记录号 | CSCD:3596400 |
源URL | [http://ir.hfcas.ac.cn:8080/handle/334002/68509] ![]() |
专题 | 中国科学院合肥物质科学研究院 |
推荐引用方式 GB/T 7714 | . 基于JavaScript切片的AJAX框架网络爬虫技术研究[J]. 计算机系统应用,2009,018. |
APA | (2009).基于JavaScript切片的AJAX框架网络爬虫技术研究.计算机系统应用,018. |
MLA | "基于JavaScript切片的AJAX框架网络爬虫技术研究".计算机系统应用 018(2009). |
入库方式: OAI收割
来源:合肥物质科学研究院
浏览0
下载0
收藏0
其他版本
除非特别说明,本系统中所有内容都受版权保护,并保留所有权利。