基于网络挖掘的上下文相关词汇级复述研究

赵世奇; 张宇; 赵琳; 刘挺; 李生

首页> 中文期刊>软件学报 >基于网络挖掘的上下文相关词汇级复述研究

基于网络挖掘的上下文相关词汇级复述研究

开具论文收录证明 >>

期刊封面封底目录下载 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

Lexical paraphrasing is the task of extracting word-level paraphrases. Lexical paraphrases should be context dependent since a word may have different paraphrases in distinct contexts. This paper investigates a framework for acquiring context-dependent lexical paraphrases, in which a web mining method is developed for extracting candidate paraphrases and a classification method is introduced in paraphrase validation. Evaluations are carried out on the People's Daily corpus and the results show that: (1) the web mining method performs well in candidate paraphrase extraction, which extracts 2.3 correct paraphrases on average for each test word in each given context sentence; (2) the classifier for paraphrase validation is effective, which achieves an f-measure of 0.6023;(3) 75.11% and 98.31% of the paraphrases extracted by our method cannot be recognized by the two widely used context-independent methods, i.e., the thesaurus-based and clustering-based methods respectively. This indicates that the presented context-dependent method is a considerable supplement to the context-independent ones.%词汇级复述研究旨在为词汇获取复述.词汇级复述是上下文相关的,即对同一个词在不同上下文中应获取不同的复述词.提出了一种获取上下文相关词汇级复述的方法.该方法包括两部分:基于网络挖掘的候选复述词获取以及基于二元分类的复述词确认.在<人民日报>语料库上的实验结果表明:(1) 基于网络挖掘的候选复述词获取方法是切实可行的,平均为每个待复述词在每个给定的上下文句子中获取2.3个正确复述词;(2) 利用二元分类的方法进行复述确认是有效的,其F值达到0.6023;(3) 利用该方法抽取得到的复述中,有75.11%和98.31%无法通过两种常用的上下文无关方法,即基于辞典和基于聚类的方法来获得.这证明了所提出的上下文相关复述方法可以有效地补充传统的上下文无关方法.

著录项

来源
《软件学报》|2009年第7期|1746-1755|共10页
作者
赵世奇; 张宇; 赵琳; 刘挺; 李生;
展开▼
作者单位

哈尔滨工业大学,计算机科学与技术学院,黑龙江,哈尔滨,150001;

哈尔滨工业大学,计算机科学与技术学院,黑龙江,哈尔滨,150001;

哈尔滨工业大学,计算机科学与技术学院,黑龙江,哈尔滨,150001;

哈尔滨工业大学,计算机科学与技术学院,黑龙江,哈尔滨,150001;

哈尔滨工业大学,计算机科学与技术学院,黑龙江,哈尔滨,150001;

展开▼
原文格式 PDF
正文语种 chi
中图分类自动推理、机器学习;
关键词
词汇级复述; 上下文相关; 网络挖掘; 复述抽取; 复述确认;
入库时间 2023-07-25 13:18:34

相似文献

中文文献
外文文献
专利

1. 基于自动构建语料库的词汇级复述研究 [J] . 赵世奇 ,刘挺 ,李生 . 电子学报 . 2009,第005期
2. 英语专业一二年级学生词汇知识深度和词汇学习策略的相关研究 [J] . 马慧 . 科技信息 . 2010,第029期
3. 基于分布的词汇级语义相关度计算综述 [J] . 孙叔琦 ,杨沐昀 . 智能计算机与应用 . 2014,第005期
4. 基于分布的词汇级语义相关度计算综述 [J] . 孙叔琦 ,杨沐昀 . 智能计算机与应用 . 2014,第005期
5. 基于知识图谱的汉语词汇学习资源推荐研究——以HSK三级词汇为例 [J] . 孙飞鹏 ,于淼 ,汤京淑 . 现代教育技术 . 2021,第001期
6. 基于语料库的《成人三级词汇学习词典》编撰实证研究 [C] . 聂丹 . 北京广播电视大学2011学术报告会 . 2011
7. 上下文相关的词汇复述研究 [A] . 赵琳 . 2008

基于网络挖掘的上下文相关词汇级复述研究

摘要

著录项

相似文献

相关主题

期刊订阅