基于多模态神经网络的图像中文摘要生成方法

刘泽宇; 马龙龙; 吴健; 孙乐

首页> 中文期刊>中文信息学报 >基于多模态神经网络的图像中文摘要生成方法

基于多模态神经网络的图像中文摘要生成方法

开具论文收录证明 >>

期刊封面封底目录下载 >>

页面导航

摘要
著录项
相似文献
相关主题

摘要

Image captioning is a cross-domain task which connects computer vision,natural language processing and machine learning.As a key technology of multimodal processing,it has made remarkable progress in the recent years.Research on image caption generation has typically focused on generating a caption in English for an image, but generating Chinese caption is lack of research.In this paper,we propose a method generating Chinese image caption based on multimodal neural network.This method belongs to the family of encoder-decoder.Encoder based on convolutional neural network,consists of single-label visual feature extraction network and multi-label keyword prediction network.Decoder based on long short-term memory,consists of multimodal caption generation network. During the process of decoding,we propose four multimodal caption generation methods:CNIC-X,CNIC-H,CNIC-C and CNIC-HC.Experimental results on Chinese multimodal dataset Flickr8k-CN show that the proposed method outperforms state-of-the-art Chinese image captioning methods.%图像的自然语言描述(image captioning)是一个融合计算机视觉、自然语言处理和机器学习的跨领域课题.它作为多模态处理的关键技术,近年来取得了显著成果.当前研究大多针对图像生成英文摘要,而对于中文摘要的生成方法研究较少.该文提出了一种基于多模态神经网络的图像中文摘要生成方法.该方法由编码器和解码器组成,编码器基于卷积神经网络,包括单标签视觉特征提取网络和多标签关键词特征预测网络,解码器基于长短时记忆网络,由多模态摘要生成网络构成.在解码过程中,该文针对长短时记忆网络的特点提出了四种多模态摘要生成方法CNIC-X、CNIC-H、CNIC-C和CNIC-HC.在中文摘要数据集Flickr8k-CN上实验,结果表明该文提出的方法优于现有的中文摘要生成模型.

著录项

来源
《中文信息学报》|2017年第6期|162-171|共10页
作者
刘泽宇; 马龙龙; 吴健; 孙乐;
展开▼
作者单位

中国科学院软件研究所中文信息处理研究室,北京100190;

中国科学院大学,北京100190;

中国科学院软件研究所中文信息处理研究室,北京100190;

中国科学院软件研究所中文信息处理研究室,北京100190;

中国科学院软件研究所中文信息处理研究室,北京100190;

展开▼
原文格式 PDF
正文语种 chi
中图分类信息处理（信息加工）;
关键词
图像中文摘要; 多模态处理; 神经网络;
入库时间 2022-08-18 06:08:18

相似文献

中文文献
外文文献
专利

1. 基于多模态神经网络生成图像中文描述 [J] . 陈兴 . 计算机系统应用 . 2020,第009期
2. 基于改进的多模态神经网络图像描述方法 [J] . 李柯徵 ,王海涌 . 计算机应用与软件 . 2021,第009期
3. 基于深度卷积神经网络方法构建肺部多模态图像分类诊断模型 [J] . 武志远 ,马圆 ,唐浩 . 中国卫生统计 . 2019,第006期
4. 基于卷积神经网络的JPEG图像隐写分析参照图像生成方法 [J] . 任魏翔 ,翟黎明 ,王丽娜 . 计算机研究与发展 . 2019,第010期
5. 基于单一图像生成对抗神经网络方法在沉积相建模中的应用 [J] . 李少华 ,史敬华 ,于金彪 . 油气地质与采收率 . 2022,第1期
6. 基于多模态神经网络的图像中文摘要生成方法 [C] . 刘泽宇 ,马龙龙 ,吴健 . 第十六届全国计算语言学学术会议暨第五届基于自然标注大数据的自然语言处理国际学术研讨会 . 2017
7. 基于卷积神经网络的多模态医学图像融合方法研究 [A] . 王蕊芳 . 2021

基于多模态神经网络的图像中文摘要生成方法

摘要

著录项

相似文献

相关主题

期刊订阅