首页> 中国专利> 一种基于状态动态感知的多智能体合作学习方法

一种基于状态动态感知的多智能体合作学习方法

摘要

本发明公开了一种基于状态动态感知的多智能体合作学习方法,通过自主训练获得协调完成任务目标的多智能体控制系统,步骤如下:对各个智能体分别进行状态编码;对每个智能体构建一个动态感知层对其状态集合进行处理,将动态长度的状态集合映射成固定长度的特征;每个智能体的特征输入到各自带有通信单元的Q值网络,从网络输出中选取具有最大Q值的动作作为决策动作;各智能体将动作执行于环境,从环境中获取反馈奖励后,对所有智能体的动态感知层参数和Q值网络参数进行更新;使用上述框架训练多智能体,获得多智能体合作控制系统。本发明适用于要求动态数量游戏角色合作完成任务的游戏系统中,可作为游戏中多智能体的人工智能系统。

著录项

  • 公开/公告号CN109978176B

    专利类型发明专利

  • 公开/公告日2021-01-19

    原文格式PDF

  • 申请/专利权人 华南理工大学;

    申请/专利号CN201910162280.9

  • 发明设计人 王桂鸿;史景伦;邓丽;张宇;

    申请日2019-03-05

  • 分类号G06N20/00(20190101);

  • 代理机构44245 广州市华学知识产权代理有限公司;

  • 代理人李斌

  • 地址 510640 广东省广州市天河区五山路381号

  • 入库时间 2022-08-23 11:29:32

相似文献

  • 专利
  • 中文文献
  • 外文文献
获取专利

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号