首页> 外文期刊>Neurocomputing >Neural Chinese word segmentation with dictionary
【24h】

Neural Chinese word segmentation with dictionary

机译:带有字典的神经汉语分词

获取原文
获取原文并翻译 | 示例
           

摘要

Chinese word segmentation (CWS) is an important task for Chinese NLP. Recently, many neural network based methods have been proposed for Chinese word segmentation. However, these methods require a large number of labeled sentences for model training, and usually cannot utilize the useful information in Chinese dictionary. In this paper, we propose two methods to exploit the dictionary information for CWS. The first one is based on pseudo labeled data generation, and the second one is based on multi-task learning. The experimental results on two benchmark datasets validate that our approach can effectively improve the performance of Chinese word segmentation, especially when training data is insufficient. (C) 2019 Elsevier B.V. All rights reserved.
机译:中文分词(CWS)是中文NLP的重要任务。近来,已经提出了许多基于神经网络的方法来进行中文分词。但是,这些方法需要大量的带标记的句子进行模型训练,通常不能利用汉语词典中的有用信息。在本文中,我们提出了两种方法来利用CWS的字典信息。第一个基于伪标记数据生成,第二个基于多任务学习。在两个基准数据集上的实验结果证明,我们的方法可以有效地提高中文分词的性能,尤其是在训练数据不足时。 (C)2019 Elsevier B.V.保留所有权利。

著录项

  • 来源
    《Neurocomputing》 |2019年第21期|46-54|共9页
  • 作者单位

    Tsinghua Univ, Dept Elect Engn, Beijing, Peoples R China;

    Microsoft Res Asia, Beijing, Peoples R China;

    Tsinghua Univ, Dept Elect Engn, Beijing, Peoples R China;

    Tsinghua Univ, Dept Elect Engn, Beijing, Peoples R China;

    Microsoft Res Asia, Beijing, Peoples R China;

  • 收录信息 美国《科学引文索引》(SCI);美国《工程索引》(EI);
  • 原文格式 PDF
  • 正文语种 eng
  • 中图分类
  • 关键词

    Chinese word segmentation; Dictionary; Neural network;

    机译:中文分词词典神经网络;

相似文献

  • 外文文献
  • 中文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号