节点文献

论文元数据信息的自动抽取

Automatic Metadata Extraction for Scientific Documents

  • 推荐 CAJ下载
  • PDF下载
  • 不支持迅雷等下载工具,请取消加速工具后下载。

【作者】 李朝光张铭邓志鸿杨冬青唐世渭

【Author】 Li Chaoguang 1 Zhang Ming 1,2 Deng Zhihong 1 Yang Dongqing 1 Tang Shiwei 21 (State Key Lab.of Vision and Hearing Processing,Peking University,Beijing100871) 2 (Dept.of Computer Science and Technology,Peking University,

【机构】 北京大学视觉与听觉处理国家重点实验室,北京大学视觉与听觉处理国家重点实验室,北京大学视觉与听觉处理国家重点实验室,北京大学视觉与听觉处理国家重点实验室,北京大学计算机科学与技术系 北京100871,北京100871北京大学计算机科学与技术系,北京100871,北京100871,?

【摘要】 为了实现在Web上电子版论文结构的查询,必须提取这些论文的标题、作者、摘要和关键字等元数据信息。在北京大学数字图书馆科技文献检索系统中利用正则表达式规则对论文元数据信息进行自动抽取。该文介绍的这种方法充分利用了论文所特有的结构,在不采用语法分析等复杂的自然语言处理手段的情况下取得了很好的效果,为面向特定领域的元信息抽取作了有益的研究和探索。

【Abstract】 In order to query structured information of Web documents,it’s vital to extract title,author,abstract and

【基金】 国家重点基础研究发展规划“973项目”(编号:G1999032705);北京大学“创建世界一流大学计划”学科建设项目“985项目
  • 【文献出处】 计算机工程与应用 ,Computer Engineering and Applications , 编辑部邮箱 ,2002年21期
  • 【分类号】TP311.13
  • 【被引频次】60
  • 【下载频次】547
节点文献中: 

本文链接的文献网络图示:

本文的引文网络