节点文献

基于特征码的大规模XML文档去重研究

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【摘要】 本文总结了目前基于XML文档的一些信息检索技术,并通过一种特征码技术,将海量的XML文档中内容重复的文档检索出来。利用可以将XML文档映射到关系数据库中的X-RESTORE技术管理、存储、查找XML文档,并利用它的解析器快速定位特征码。将特征码通过高效的B+树来索引,大大提高系统的处理效率。

【关键词】 XML信息检索特征码技术X-RESTORE,B+树
【基金】 国家自然科学基金项目(60473042)
  • 【文献出处】 中国管理信息化(综合版) ,China Management Informationization , 编辑部邮箱 ,2006年07期
  • 【分类号】TP312.2
  • 【被引频次】4
  • 【下载频次】101
节点文献中: 

本文链接的文献网络图示:

本文的引文网络