基于规则匹配与深度学习AbTransformer的渔业标准表格信息抽取方法
万方数据知识服务平台
应用市场
我的应用
会员HOT
万方期刊
×

点击收藏,不怕下次找不到~

@万方数据
会员HOT

期刊专题

10.16535/j.cnki.dlhyxb.2022-305

基于规则匹配与深度学习AbTransformer的渔业标准表格信息抽取方法

引用
为解决渔业标准文本中表格结构多样、表头位置不固定导致抽取效果不佳的问题,提出一种结合规则匹配(rule-based-matching,RBM)与AbTransformer(Absolute Transformer)深度学习模型的表格信息抽取方法,该方法对规则类表格信息采用规则模板与BERT-BiLSTM-CRF模型进行信息抽取,对非规则类表格信息采用改进的Transformer进行抽取,即在位置编码模块中引入行位置编码,与特征向量拼接以获取表格行列位置.结果表明:本文中提出的 AbTransformer 模型相较于机器学习 MLP 模型,AUC 值提升了1.46%,相较于TabTransformer模型,AUC值提高了 1.18%;本文中提出的RBM-AbTransformer模型与Ab-Transformer模型相比,准确率、召回率和 F1 值分别提高了 7.78%、4.19%和 5.27%.研究表明,结合RBM与 AbTransformer的渔业标准表格信息抽取方法,有效解决了表格结构多样、表头位置不固定的问题,提升了渔业标准表格信息抽取的整体效果.

渔业标准、实体识别、表格信息抽取、深度学习、Transformer模型

38

S932.2;TP391(水产资源)

教育部重点实验室开放基金;国家自然科学基金

2023-03-23(万方平台首次上网日期,不代表论文的发表时间)

共9页

140-148

相关文献
评论
暂无封面信息
查看本期封面目录

大连海洋大学学报

2095-1388

21-1575/S

38

2023,38(1)

相关作者
相关机构

专业内容知识聚合服务平台

国家重点研发计划“现代服务业共性关键技术研发及应用示范”重点专项“4.8专业内容知识聚合服务技术研发与创新服务示范”

国家重点研发计划资助 课题编号:2019YFB1406304
National Key R&D Program of China Grant No. 2019YFB1406304

©天津万方数据有限公司 津ICP备20003920号-1

信息网络传播视听节目许可证 许可证号:0108284

网络出版服务许可证:(总)网出证(京)字096号

违法和不良信息举报电话:4000115888    举报邮箱:problem@wanfangdata.com.cn

举报专区:https://www.12377.cn/

客服邮箱:op@wanfangdata.com.cn