首页> 外文期刊>Neurocomputing >Neural Chinese word segmentation with dictionary
【24h】

Neural Chinese word segmentation with dictionary

机译:用字典的神经汉语词分割

获取原文
获取原文并翻译 | 示例
           

摘要

Chinese word segmentation (CWS) is an important task for Chinese NLP. Recently, many neural network based methods have been proposed for Chinese word segmentation. However, these methods require a large number of labeled sentences for model training, and usually cannot utilize the useful information in Chinese dictionary. In this paper, we propose two methods to exploit the dictionary information for CWS. The first one is based on pseudo labeled data generation, and the second one is based on multi-task learning. The experimental results on two benchmark datasets validate that our approach can effectively improve the performance of Chinese word segmentation, especially when training data is insufficient. (C) 2019 Elsevier B.V. All rights reserved.
机译:中文字分割(CWS)是中国NLP的重要任务。最近,已经提出了许多基于神经网络的方法,用于中文字分。但是,这些方法需要大量标记的模型训练句子,通常不能利用中文字典中的有用信息。在本文中,我们提出了两种方法来利用CWS的字典信息。第一个基于伪标记的数据生成,第二个是基于多任务学习。两个基准数据集上的实验结果验证了我们的方法可以有效地提高中文分割的性能,特别是当培训数据不足时。 (c)2019 Elsevier B.v.保留所有权利。

著录项

  • 来源
    《Neurocomputing》 |2019年第21期|46-54|共9页
  • 作者单位

    Tsinghua Univ Dept Elect Engn Beijing Peoples R China;

    Microsoft Res Asia Beijing Peoples R China;

    Tsinghua Univ Dept Elect Engn Beijing Peoples R China;

    Tsinghua Univ Dept Elect Engn Beijing Peoples R China;

    Microsoft Res Asia Beijing Peoples R China;

  • 收录信息 美国《科学引文索引》(SCI);美国《工程索引》(EI);
  • 原文格式 PDF
  • 正文语种 eng
  • 中图分类
  • 关键词

    Chinese word segmentation; Dictionary; Neural network;

    机译:中文字典;字典;神经网络;

相似文献

  • 外文文献
  • 中文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号