首页> 外文会议>システム制御情報学会研究発表講演会 >複素行動価値を適用したQ学習における学習効率向上のための考察
【24h】

複素行動価値を適用したQ学習における学習効率向上のための考察

机译:考虑提高Q学习效率的学习效率,施加复杂的行为价值

获取原文

摘要

人間の学習過程をコンピュータ上で再現することを目的に行われてきた研究として強化学習[1] がある.本研究では,強化学習の実用上の問題点である不完全知覚問題を解決するための手法のひとつとして提案されている複素強化学習[2] を,フィールド設定手法や更新方法などの点において改善し,従来手法との比較検討を行った.また,Q-learningが行動価値と文脈を別々に保持している点に着目し,行動価値をエージェントが共有できる問題ごとに一貫した行動規則と見なしてエージェント間で複素行動価値の絶対値を継承することを提案し,その有効性を検証した.
机译:作为在计算机上再现人类学习过程的目的,有一种研究,可以进行加强学习[1]作为再现人类学习过程的研究。在这项研究中,我们改进了复杂的强化学习[2],提出作为解决不完全感知问题的方法之一,这是加强学习的实际问题,并与传统方法进行比较。此外,关注Q-Learning持有行为值和上下文的点,行为值被视为代理可以共享的每个问题的一致行为规则,并继承代理之间的复杂行为值的绝对值建议提出并验证其有效性。

著录项

相似文献

  • 外文文献
  • 中文文献
  • 专利
获取原文

客服邮箱:kefu@zhangqiaokeyan.com

京公网安备:11010802029741号 ICP备案号:京ICP备15016152号-6 六维联合信息科技 (北京) 有限公司©版权所有
  • 客服微信

  • 服务号