基于领域自适应的无监督文本关键词提取模型——以“人工智能风险”领域文本为例

毛立琦; 石拓; 吴林; 马涛

首页> 中文期刊> 《情报理论与实践》 >基于领域自适应的无监督文本关键词提取模型——以“人工智能风险”领域文本为例

基于领域自适应的无监督文本关键词提取模型——以“人工智能风险”领域文本为例

开具论文收录证明 >>

文献代查 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

[目的/意义]针对专业领域研究人员难以从大量无监督文本数据中快速获取领域关键知识,以精准把握专业研究方向和内容。[方法/过程]文章提出一种基于迁移学习领域自适应的文本关键词提取模型。首先通过采集中国知网中特定领域的文章和关键词,将其作为目标域数据,将待提取关键词的无监督文本作为源域数据,通过最小化二者间的共享相似特征和关键词分类交叉熵,实现关键词提取方法的跨领域迁移,完成对无监督领域文本的关键词提取任务。[结果/结论]对1313篇“人工智能风险”主题的文章进行领域关键词提取,实验表明该领域关键词提取模型相比于BiLSTM-CRF、TF-IDF模型提取效果提升显著,在领域关键知识提取场景中有较强应用价值。

著录项

来源
《情报理论与实践》 |2022年第3期|182-187|共6页
作者
毛立琦; 石拓; 吴林; 马涛;
展开▼
作者单位

南京大学;

江苏南京210093;

北京警察学院;

北京102202;

中国传媒大学;

北京100024;

中国兵器工业集团有限公司;

北京100089;

展开▼
原文格式 PDF
正文语种 chi
中图分类文字信息处理;
关键词
领域自适应; 迁移学习; BiLSTM-CRF; 领域关键词; 无监督;

相似文献

中文文献
外文文献
专利

1. 基于BERT模型的无监督中文单文本关键词提取模型 [J] . 顾淳 ,俞成海 ,于洋 . 浙江理工大学学报：自然科学版 . 2022,第3期
2. 面向中医古籍文本的领域自适应性无监督分词 [J] . 张素华 ,叶青 ,程春雷 . 软件导刊 . 2022,第1期
3. 领域对齐对抗的无监督跨领域文本情感分析算法 [J] . 贾熹滨 ,曾檬 ,米庆 . 计算机研究与发展 . 2022,第6期
4. 文本挖掘下的话语认知与构建——以人工智能和5G领域白宫新闻文本为例 [J] . 张誉曜 ,陈媛媛 . 农业图书情报学报 . 2021,第4期
5. 文本挖掘下的话语认知与构建——以人工智能和5G领域白宫新闻文本为例 [J] . 张誉曜 ,陈媛媛 . 农业图书情报学刊 . 2021,第4期
6. 基于领域关键词的词典及语言模型自适应 [C] . 黄非 . 计算语言学文集 . -1
7. 无监督的专利文本关键词提取研究 [A] . 刘学颖 . 2020

基于领域自适应的无监督文本关键词提取模型——以“人工智能风险”领域文本为例

摘要

著录项

相似文献

相关主题

期刊订阅