10.3969/j.issn.1003-0077.2010.01.017
基于领域类别信息C-value的多词串自动抽取
该本的多词串抽取是自然语言处理领域一项重要的研究内容.该文提出了一种多类别C-value(Multi-Class C-value)方法,利用多词串在不同领域的分布信息改善领域相关的多词串抽取的性能.在汽车、科技和旅行三个领域的数据上进行实验,评价多词串的准确率,在top-100级别上,较传统的C-value方法在三个领域中分别提高了12、12和13个百分点.实验结果验证了方法的有效性.
计算机应用、中文信息处理、多词串抽取、多类别C-value、领域信息
24
TP391(计算技术、计算机技术)
国家自然科学基金资助项目60873091;辽宁省自然科学基金资助项目20072032;沈阳市科学技术计划资助项目1081235-1-00
2010-04-06(万方平台首次上网日期,不代表论文的发表时间)
共5页
94-98