10.3969/j.issn.1008-0570.2008.18.080
半结构化文本中的表格识别技术研究
表格作为网页的一部分,蕴含丰富的信息,因而表格的识别工作已经成为了一个很值得研究的课题.把表格识别看作是一个分类问题,提出了一种新的用最大熵模型来解决这一问题的方法.实验证明,该方法对表格识别的F度量能够达到95.82%.
信息提取、最大熵模型、表格识别
24
TP393(计算技术、计算机技术)
国家自然科学基金资助项60435020
2008-09-01(万方平台首次上网日期,不代表论文的发表时间)
共3页
198-199,291