节点文献

基于XML的Web中文文本挖掘系统设计

Design of A Web Text Mining System Based on XML

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 张霄军张凌岚

【Author】 ZHANG Xiaojun ZHANG Linglan

【机构】 上海电力学院上海神源电气有限公司

【摘要】 语料文本的挖掘和文本语料库的建设对语言学研究具有重要意义,因此语料文本的挖掘和文本语料库的建设就越来越值得探讨。但由于Web上文本的半结构化特征和异构文本源的问题,在Web上的文本挖掘具有很多困难。本文提出了将XML技术与Web挖掘技术相结合,根据研究者的个人需求定制个性化的Web中文文本挖掘系统框架和实现方案,并给出了面向法律领域的Web文本挖掘系统LawsMiner的实例。

【Abstract】 Corpus plays more and more important role in the modern language studies. It’s worth studying on text mining and corpus building for the linguists. This paper points out a web Chinese text mining system which uses XML technique in web mining to set a personal web text mining. A system named LawsMiner focusing on law texts is applied.

【关键词】 Web文本挖掘XMLLawsMiner语料库
【Key words】 webtext miningLawsMinerXMLcorpus
  • 【文献出处】 术语标准化与信息技术 ,Terminology Standardization & Information Technology , 编辑部邮箱 ,2004年03期
  • 【分类号】TP393.09
  • 【被引频次】5
  • 【下载频次】293
节点文献中: 

本文链接的文献网络图示:

本文的引文网络