节点文献

一种挖掘XML文档频繁子树的方法

A Method to Mine Frequent Trees in XML Documents

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 傅珊珊吴扬扬

【Author】 FU Shan-shan,WU Yang-yang(Department of Computer Science,Huaqiao University,Quanzhou 362021,China)

【机构】 华侨大学计算机科学系华侨大学计算机科学系 福建泉州362021福建泉州362021

【摘要】 本文主要研究从由带标签有序树构成的森林中挖掘嵌入式频繁子树,具体做法是:首先对XML文档进行预处理,生成最简结构树SST,然后从SST中挖掘出频繁子树。本文提出了SSTMiner算法,该算法针对TreeMiner算法存在的瓶颈问题,结合当前所处理的SST的结构特点进行改进,进一步提高了算法执行的效率。实验证明,本文提出的方法能够准确高效地挖掘出XML文档中的频繁子树。

【Abstract】 This paper studies the problem of mining embedded subtrees in a forest of labeled and ordered trees.The method is that we first preprocess XML documents to get SSTs(Simplest Structural Trees) and then mine frequent trees in SSTs.In this paper,we improve TreeMiner by breaking the bottleneck of TreeMiner and present an algorithm called SSTMiner.The experiments show that this method is efficient to mine frequent trees in XML documents.

【关键词】 XML频繁子树TreeMiner
【Key words】 XMLfrequent treeTreeMiner
【基金】 福建省自然科学基金资助项目(A0510020)
  • 【文献出处】 计算机工程与科学 ,Computer Engineering & Science , 编辑部邮箱 ,2007年10期
  • 【分类号】TP312.2
  • 【被引频次】2
  • 【下载频次】91
节点文献中: