| 
  中国学术期刊网络出版总库
  关闭
基于底表的多层扫描术语自动标注算法  
   推荐 CAJ下载 PDF下载
【英文篇名】 Term Auto-tagging Algorithm Based on Base Glossary
【下载频次】 ★★★
【作者】 郑泽芝; 敖婷;
【英文作者】 ZHENG Ze-zhi; AO Ting(College of the Humanities; Xiamen University; Xiamen 361005; China);
【作者单位】 厦门大学人文学院; 福建卫生职业技术学院;
【文献出处】 厦门大学学报(自然科学版) , Journal of Xiamen University(Natural Science), 编辑部邮箱 2011年 03期  
期刊荣誉:中文核心期刊要目总览  ASPT来源刊  中国期刊方阵  CJFD收录刊
【中文关键词】 术语; 自动标注; 规则; 术语部件;
【英文关键词】 term; auto-tagging; rule; term component;
【摘要】 以学科教材术语语料库建设为目标,实现了一种基于底表的多层扫描术语自动标注算法.该算法首先采用预测性规则模板扫描文本中未登录术语,并进行标注;其次采用最大匹配方法识别出每个可能的候选术语,把每个候选术语看作术语的定位点,扫描其上下文语境,分别调用单位术语规则模板、例外规则、部件规则、部件例外规则、例外校正规则等对扫描结果进行判断,确定候选术语的身份,并进行标注.该方法以规则的预测和限定功能为辅,充分利用了底表术语信息,取得了较高的标注准确率和召回率,开放测试F-指数达到了84%左右.
【英文摘要】 A multi-scanning algorithm based on base glossary was designed for constructing a teaching material term corpus.Firstly,the term auto-tagging process scans and labels terms which match the prediction templates;secondly,finds out every candidate terms with the maximum matching algorithm based on a base glossary,and takes every candidate term as an anchor point,scans the context of the anchor point,calls the unit-term templates,exceptional-correct rules,term component and component exceptional rules in tern t...
【基金】 国家社会科学基金项目(10BYY041); 国家语言资源监测与研究中心资助项目(E080106-02)
【更新日期】 2011-06-22
【分类号】 TP391.1
【正文快照】 术语是构成学科知识的核心内容,学科教育的核心问题就是理解和掌握学科术语以及习惯表达,并最终把这些内容融入学生的语言系统.目前,术语研究少有关于基础教育学科教材定量化系统化的研究,其根本原因是缺乏成规模系统化的术语语料库.建设一定规模的具有研究意义的术语语料库和?

xxx
【读者推荐文章】中国期刊全文数据库 中国博士学位论文全文数据库 中国优秀硕士学位论文全文数据库 中国重要会议论文全文数据库
【相似文献】
中国期刊全文数据库
中国优秀硕士学位论文全文数据库
中国博士学位论文全文数据库
中国重要会议论文全文数据库
中国重要报纸全文数据库
中国学术期刊网络出版总库
点击下列相关研究机构和相关文献作者,可以直接查到这些机构和作者被《中国知识资源总库》收录的其它文献,使您全面了解该机构和该作者的研究动态和历史。
【文献分类导航】从导航的最底层可以看到与本文研究领域相同的文献,从上层导航可以浏览更多相关领域的文献。

工业技术
  自动化技术、计算机技术
   计算技术、计算机技术
    计算机的应用
     信息处理(信息加工)
      文字信息处理
  
 
  CNKI系列数据库编辑出版及版权所有:中国学术期刊(光盘版)电子杂志社
中国知网技术服务及网站系统软件版权所有:清华同方知网(北京)技术有限公司
其它数据库版权所有:各数据库编辑出版单位(见各库版权信息)
京ICP证040431号    互联网出版许可证 新出网证(京)字008号