节点文献

一种规则与统计相结合的汉语分词方法

A Method Combining Rule-based and Statistics-based Approaches for Chinese Word Segmentation

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 赵伟戴新宇尹存燕陈家骏

【Author】 ZHAO Wei,DAI Xin-yu,YIN Cun-yan,CHEN Jia-jun Technology,Nanjing University ,Nanjing Jiangsu 210093,China)

【机构】 南京大学计算机科学与技术系软件新技术国家重点实验室南京大学计算机科学与技术系软件新技术国家重点实验室 江苏南京210093江苏南京210093江苏南京210093

【摘要】 汉语自动分词是中文信息处理领域的一项基础性课题,对现有的汉语分词方法作了简单的概述和分析,然后提出了一种新的分词方法,该方法基于一个标注好了的语料库,并且结合了规则和语料库统计两种分词方法。

【Abstract】 Chinese automatic word segmentation is a basic task in the area of Chinese NLP.After summarizing and analyzing current techniques used in Chinese word segmentation,this paper presents a new method for word segmentation which is based on a marked corpus base.The method combines rule-based and corpus-based statistical methods.

【基金】 国家"863"基金资助项目(2001AA114102)
  • 【文献出处】 计算机应用研究 ,Application Research of Computers , 编辑部邮箱 ,2004年03期
  • 【分类号】TP391.1
  • 【被引频次】140
  • 【下载频次】568
节点文献中: 

本文链接的文献网络图示:

本文的引文网络