首页> 中文期刊> 《计算机工程》 >提高韵律短语正确切分方法的研究

提高韵律短语正确切分方法的研究

         

摘要

汉语自动词性标注和韵律短语切分都是汉语文语转换(Text-to-Speech)系统的重要组成部分.在用从人工标注的语料库中得到韵律短语切分点的边界模式以及概率信息,对文本中的韵律短语切分点进行自动预测时,语素′g′这种词性就过于模糊,导致韵律短语切分点预测得不合理.该文提出了一种修改词类标注集,去掉语素′g′这种词性的方法.该方法在进行词性标注时,对实语素恰当地标注出在句中的词性,以便提高韵律短语的正确切分.应用此方法对10万词的训练集和5万词的测试集分别进行封闭和开放测试表明,词性标注正确率分别可达96.67%和192.60%.并采用修改过的词类标注集,对1000句的文本进行了韵律短语切分点的预测,召回率在66.21%左右,正确率达到了7579%.

著录项

相似文献

  • 中文文献
  • 外文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号