基于LDA主题模型的维吾尔语无监督词义消歧

袁扬; 李晓; 杨雅婷

首页> 中文期刊>厦门大学学报（自然科学版） >基于LDA主题模型的维吾尔语无监督词义消歧

基于LDA主题模型的维吾尔语无监督词义消歧

开具论文收录证明 >>

期刊封面封底目录下载 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

维吾尔语是典型的资源稀缺型语言,由于词义消歧标注语料资源和语义分析工具的不足,导致传统的有监督方法难以实现.针对该问题,将篇章文本的词义消歧问题类比为文本主题分类问题,在LDA(latent Dirichlet allocation)主题模型的基础上提出了一种维吾尔语无监督词义消歧模型.为强化主题模型对歧义词语义项的分类性能,加入了3个数据预处理过程:去除停用词,过滤有效词和强化同义词词频权重.实验结果表明,在随机抽取的63组测试样本集中,该模型的词义消歧准确率达到65.08%,在篇章文本采样词任务中词义消歧准确率达到61.2%.

著录项

来源
《厦门大学学报（自然科学版）》|2020年第2期|198-205|共8页
作者
袁扬; 李晓; 杨雅婷;
展开▼
作者单位

中国科学院新疆理化技术研究所新疆乌鲁木齐 830011;

中国科学院大学北京 100049;

新疆民族语音语言信息处理实验室新疆乌鲁木齐 830011;

展开▼
原文格式 PDF
正文语种 chi
中图分类信息处理（信息加工）;
关键词
维吾尔语; 无监督词义消歧; 主题模型; 语义相似度; 同义词;
入库时间 2023-07-25 12:35:12

相似文献

中文文献
外文文献
专利

1. 基于半监督LDA主题模型的ZeroNet文本内容分析 [J] . 过小宇 ,丁建伟 ,江泓 . 信息技术 . 2020,第003期
2. 基于词向量的无监督词义消歧方法 [J] . 吕晓伟 ,章露露 . 软件导刊 . 2018,第009期
3. 基于知网义原词向量表示的无监督词义消歧方法 [J] . 唐共波 ,于东 ,荀恩东 . 中文信息学报 . 2015,第006期
4. 有监督主题模型的SLDA-TC文本分类新方法 [J] . 唐焕玲 ,窦全胜 ,于立萍 . 电子学报 . 2019,第006期
5. 基于Biterm主题模型的无监督微博情感倾向性分析 [J] . 张佳明 ,王波 ,唐浩浩 . 计算机工程 . 2015,第007期
6. 基于知网义原词向量表示的无监督词义消歧方法 [C] . TANG Gongbo ,唐共波 ,YU Dong . 中国中文信息学会2015学术年会（CIPS2015）暨第十四届全国计算语言学学术会议（CCL2015）、第三届基于自然标注大数据的自然语言处理国际学术研讨会（NLP-NABD2015） . 2015
7. 基于主题模型的无监督方面级观点挖掘算法研究 [A] . 冯晋田 . 2019

基于LDA主题模型的维吾尔语无监督词义消歧

摘要

著录项

相似文献

相关主题

期刊订阅