首页> 中国专利> 基于多任务学习的中文拼写纠错方法

基于多任务学习的中文拼写纠错方法

摘要

本发明提供了一种基于多任务学习的中文拼写纠错方法,包括:步骤1,将样例句文本和标签句文本以特定格式输入文本编码模块,文本编码模块输出文本向量;步骤2,将文本向量中句子起始的标识符对应的向量输入正确句判别模块;步骤3,将文本向量中样例句对应的向量输入字级别多分类模块,字级别多分类模块将输出输入候选字生成模块的语义混淆集中。本发明提出了正确句判别任务,通过在训练过程中构建句子对,模型需要识别句子对中不含错误的句子,能够让模型具有基于句子级别分辨正确语句与错误语句的能力,同时和预训练模型的句子对顺序预测任务较好契合,更好的挖掘利用了预训练模型在拼写校对领域的能力,具备更好的识别正确句的能力。

著录项

  • 公开/公告号CN114065738A

    专利类型发明专利

  • 公开/公告日2022-02-18

    原文格式PDF

  • 申请/专利权人 湖南达德曼宁信息技术有限公司;

    申请/专利号CN202210023934.1

  • 发明设计人 刘洋;刘酃威;林中尧;

    申请日2022-01-11

  • 分类号G06F40/232(20200101);G06F40/166(20200101);G06F16/35(20190101);

  • 代理机构43235 长沙轩荣专利代理有限公司;

  • 代理人汪金连

  • 地址 410000 湖南省长沙市雨花区金海路128号领智工业园A2栋502号

  • 入库时间 2023-06-19 14:14:25

法律信息

  • 法律状态公告日

    法律状态信息

    法律状态

  • 2022-03-08

    实质审查的生效 IPC(主分类):G06F40/232 专利申请号:2022100239341 申请日:20220111

    实质审查的生效

相似文献

  • 专利
  • 中文文献
  • 外文文献
获取专利

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号