节点文献

基于XML的Web数据半自动采集

Web Data Sime-automatic Extraction Based on XML

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 蒋宏潮王大亮班晓娟阮进喜

【Author】 JIANG Hong-chao,WANG Da-liang,BAN Xiao-juan,RUAN Jin-xi (School of Information Engineering,University of Science and Technology Beijing,Beijing 100083)

【机构】 北京科技大学信息工程学院

【摘要】 如何在信息量巨大的互联网上准确获取并长期跟踪用户关注的内容,是数据采集和挖掘的重要方面。探讨Web数据采集理论及其应用技术,给出一个半自动采集模型,设计基于旅游业数据的采集系统,验证数据半自动采集的可行性。

【Abstract】 It is an important aspect of data extraction and mining that how to exactly gain and chronically trace the content regarded by users on Internet with huge information. This paper discusses Web data extraction theories and its application technologies,gives a sime-automatic extraction model,and designs a extraction system based on tourism industry data to prove the feasibility data sime-automatic extraction.

【基金】 国家“863”计划基金资助项目(2007AA01Z170)
  • 【文献出处】 计算机工程 ,Computer Engineering , 编辑部邮箱 ,2009年21期
  • 【分类号】TP393.092
  • 【被引频次】6
  • 【下载频次】147
节点文献中: 

本文链接的文献网络图示:

本文的引文网络