| 
  中国优秀硕士学位论文全文数据库
  关闭
基于CCD的术语抽取研究  
   在线阅读 整本下载 分章下载 分页下载本系统暂不支持迅雷或FlashGet等下载工具
【作者】 段国成;
【导师】 范明; 昝红英;
【学位授予单位】 郑州大学;
【学科专业名称】 计算机软件与理论
【学位年度】 2007
【论文级别】 硕士
【网络出版投稿人】 郑州大学
【网络出版投稿时间】 2007-08-24
【关键词】 术语抽取; 中文概念词典; CCD; 法律术语;
【英文关键词】 term extraction; Chinese Concept Dictionary; law term; term extraction plat;
【中文摘要】 术语自动抽取是计算术语学中最重要的任务之一,它的主要目的是从专门领域的文本集中识别出能代表本领域的文本单元的集合,如词语等。术语抽取是自然语言信息处理中的一项基础性课题,在很多领域都有广泛的应用,如自然语言生成、计算词典编撰学、句法分析、语料库语言学的研究、统计机器翻译、信息检索、文本分类、文本摘要等领域。 本文首先介绍了领域术语的概念和特征,然后介绍了术语自动抽取的各种方法以及特点,以及术语自动抽取存在的不足之处。本文利用术语的语言特征和统计特征进行术语抽取系统的研究与实现,提出了基于一般词典和种子信息的单个词术语抽取的方法,又提出了如何进行二元术语抽取的算法初步研究,克服了目前术语抽取中存在的一些问题。在香港法律语料库(BLIS)上报告了我们以上方法的实验结果。 本文的主要工作包括: ①详细介绍了术语的相关概念,术语自动抽取的各种方法及特点,同时向大家介绍了各种语言资源,如中文概念词典(chinese Concept Dictionary,CCD)法律词库及BLIS语料库。 ②详细介绍...
【英文摘要】 Automatic term extraction (ATE) is one of the most important tasks in computational terminology. Its primary goal is to identify a set of text units, e.g. words, from a collection of texts from a specific subject field that represent the key concepts in that field. Term extraction is fundamental issue in natural language information processing. It has been applied in many other fields of natural language processing, such as Natural Language Generation, Computational Lexicography, Parsing, Corp...
【更新日期】 2007-09-30

xxx
【读者推荐文章】中国期刊全文数据库 中国重要报纸全文数据库 中国博士学位论文全文数据库 中国优秀硕士学位论文全文数据库 中国重要会议论文全文数据库
【相似文献】
中国期刊全文数据库
中国优秀硕士学位论文全文数据库
中国博士学位论文全文数据库
中国重要会议论文全文数据库
中国重要报纸全文数据库
中国学术期刊网络出版总库
点击下列相关研究机构和相关文献作者,可以直接查到这些机构和作者被《中国知识资源总库》收录的其它文献,使您全面了解该机构和该作者的研究动态和历史。
【文献分类导航】从导航的最底层可以看到与本文研究领域相同的文献,从上层导航可以浏览更多相关领域的文献。

工业技术
  自动化技术、计算机技术
   计算技术、计算机技术
    计算机的应用
     信息处理(信息加工)
      文字信息处理
  
 
  CNKI系列数据库编辑出版及版权所有:中国学术期刊(光盘版)电子杂志社
中国知网技术服务及网站系统软件版权所有:清华同方知网(北京)技术有限公司
其它数据库版权所有:各数据库编辑出版单位(见各库版权信息)
京ICP证040431号    互联网出版许可证 新出网证(京)字008号