首页> 中文期刊> 《大连海洋大学学报》 >基于BERT+BiLSTM+CRF深度学习模型和多元组合数据增广的渔业标准命名实体识别

基于BERT+BiLSTM+CRF深度学习模型和多元组合数据增广的渔业标准命名实体识别

         

摘要

为解决渔业标准命名实体识别任务中部分实体语料分布稀疏导致的效果不佳问题,提出了基于多元组合数据增广(data augmentation method based on multiple combination,MCA)的渔业标准命名实体识别方法,该方法融合了基于领域词典的联合替换算法(joint replacement algorithm based on domain dictionary,DDR)、基于槽点保护的随机删除算法(random deletion algorithm based on slot protection,SPD)和基于槽点保护的随机插入算法(random insertion algorithm based on slot protection,SPI)进行语料库的数据增广,首先构建“水产品名称”同类词词典和领域同义词词典,通过两个词典分别对“水产品名称”类实体和随机词进行同类词替换和同义词替换,生成新的句子,以增加目标实体数量和句子的多样性,然后在基于槽点保护的情况下对原句子分别进行随机删除和随机插入操作,在保留实体及上下文特征的情况下进一步丰富语料的多样性,提高模型的泛化能力。结果表明,采用基于融合注意力机制的BERT+BiLSTM+CRF网络模型和多元组合数据增广方法进行渔业标准命名实体识别,准确率、召回率、F1值分别达到了91.73%、88.64%、90.16%,具有较好的效果。研究表明,基于多元组合数据增广的渔业标准命名实体识别方法有效解决了部分实体样本稀疏问题,提升了渔业标准命名实体识别的整体效果。

著录项

  • 来源
    《大连海洋大学学报》 |2021年第4期|P.661-669|共9页
  • 作者单位

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023设施渔业教育部重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023;

    大连海洋大学信息工程学院 辽宁省海洋信息技术重点试验室 辽宁大连116023设施渔业教育部重点试验室 辽宁大连116023;

  • 原文格式 PDF
  • 正文语种 chi
  • 中图分类 综合科学调查;
  • 关键词

    深度学习; 实体识别; 数据增广; BERT; 双向长短时记忆网络; 渔业标准;

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号