节点文献

从复杂XML文档中抽取目标关系片段的方法

A Method of Extracting Target Relation Fragments from Complicated XML Documents

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 雷庆吴扬扬缑锦

【Author】 LEI Qing, WU Yang-yang, GOU Jin(College of Computer Science and Technology,Huaqiao University,Quanzhou 362021,China)

【机构】 华侨大学计算机科学与技术学院

【摘要】 针对以往关系信息挖掘中存在的复杂XML文档相似度计算精度不高的问题,提出通过发现包含目标关系信息的最小公共祖先节点SCATR,以SCATR节点为根对复杂文档进行片段划分,并按片段的相似度进行聚类,目的在于改善已有模型对复杂XML文档的识别效果.实验结果表明,通过抽取包含目标关系的文档片段,去除文档片段中无关分枝,能够有效地帮助已有模型从复杂XML文档中识别和抽取出目标关系信息.

【Abstract】 To improve the low precision in calculating similarity of complicated XML documents in the work of relation mining,a method of dealing with complicated XML documents is proposed.The collections of SCATR are identified in the documents according to users’ requirement,and then the documents are split into fragments which are rooted at SCATR,and target XML fragments are discerned by calculating the similarity between the users’ mining pattern and XML fragments.The experimental results show that the method can help to identify and extract target relation from complicated XML documents.

【关键词】 关系信息XML相似度模式匹配
【Key words】 relationXML similaritypattern matching
【基金】 华侨大学科研基金资助项目,编号07HZR27;福建省自然科学基金资助项目,编号A0710013
  • 【文献出处】 郑州大学学报(理学版) ,Journal of Zhengzhou University(Natural Science Edition) , 编辑部邮箱 ,2009年01期
  • 【分类号】TP312.2
  • 【下载频次】52
节点文献中: 

本文链接的文献网络图示:

本文的引文网络