188宝金博页面版

  • 图案背景
  • 纯色背景
视图
标记
批注
批注本地保存成功,开通会员云端永久保存 去开通
uhbnkllhn

上传于:2015-12-31

粉丝量:1

该文档贡献者很忙,什么也没留下。


  • 相关
  • 目录
  • 笔记
  • 书签

188宝金博页面版:更多相关文档

  • 基于强化学习算法的电梯动态调度策略的研究

    星级: 82 页

  • 基于强化学习算法的电梯动态调度策略的研究

    星级: 84 页

  • 基于强化学习算法的电梯动态调度策略的研究

    星级: 79 页

  • 基于强化学习算法的电梯动态调度策略的研究

    星级: 78 页

  • 基于强化学习算法的电梯动态调度策略的研究【控制理论与控制工程专业优秀论文】

    星级: 78 页

  • 基于强化学习算法的电梯调度系统的研究

    星级: 80 页

  • 基于强化学习算法的电梯调度系统的研究

    星级: 79 页

  • 基于强化学习算法的电梯调度系统的研究

    星级: 81 页

  • 基于强化学习算法的电梯调度系统的研究

    星级: 76 页

  • 基于平均型强化学习算法的动态调度方法的研究

    星级: 66 页

  • 基于平均型强化学习算法的动态调度方法的研究

    星级: 67 页

  • 基于平均型强化学习算法的动态调度方法的研究

    星级: 66 页

  • 基于平均型强化学习算法的动态调度方法的研究

    星级: 68 页

  • 基于强化学习算法的电梯调度系统的入研究

    星级: 81 页

  • 于强化学习算法的电梯调度系统的研究(精品)

    星级: 82 页

暂无目录

点击鼠标右键菜单,创建目录

暂无笔记

选择文本,点击鼠标右键菜单,添加笔记

暂无书签

在左侧文档中,点击鼠标右键,添加书签

188宝金博页面版: 基于强化学习算法的电梯动态调度策略的研究

下载积分: 500

内容提示: 中文摘要本文主要研究了基于强化学习的电梯群组调度。由于电梯群组系统重要的实际意义, 电梯群组的调度问题得到广泛关注。 电梯系统是一类在连续时间和空间中运行的离散事件动念系统( D E D S ), 为探索解决问题的有效方法, 首先对D E D S 调度方法进行研究。 在总结D E D S 调度方法及应用领域的基础上, 将其归类为传统方法、 智能方法和强化学习方法。强化学习作为动态规划的近似算法起源于人工智能领域, 随着强化学习的数学基础取得突破性迸展, 逐渐引起人工智能、 控制理论和运筹学等领域的研究兴趣。 论文研究了强化学习原理及发展历史, 分析了其框架背景及其避免了在...

文档格式:PDF | 页数:78 | 浏览次数:80 | 上传日期:2015-12-31 23:47:07 | 文档星级:
中文摘要本文主要研究了基于强化学习的电梯群组调度。由于电梯群组系统重要的实际意义, 电梯群组的调度问题得到广泛关注。 电梯系统是一类在连续时间和空间中运行的离散事件动念系统( D E D S ), 为探索解决问题的有效方法, 首先对D E D S 调度方法进行研究。 在总结D E D S 调度方法及应用领域的基础上, 将其归类为传统方法、 智能方法和强化学习方法。强化学习作为动态规划的近似算法起源于人工智能领域, 随着强化学习的数学基础取得突破性迸展, 逐渐引起人工智能、 控制理论和运筹学等领域的研究兴趣。 论文研究了强化学习原理及发展历史, 分析了其框架背景及其避免了在状态空间中做耗尽式搜索而导致的不可计算问题的特点以及环境模型不再是计算要素的特点, 并建立强化学习基本模型。 另外, 论文根据不同的框架背景对强化学习方法做了分类性研究和典型算法阐述, 建立了研究强化学习方法解决实际问题的一般步骤, 这对后续研究起指导性意义。强化学习方法作为在与环境的交互过程中学习最优策略的方法, 适合于求解电梯群组调度这种大规模动态优化问题。 论文在详细分析电梯群组调度领域特点的基础上, 总结出电梯群组调度的三大难点, 即问题状态空间大、 系统运行过程伴随极大的不确定性和重派梯导致的大计算量。 以马尔可夫决策过程( M D P )为背景, 模型化电梯群组调度问题, 根据领域特点定义模型各要素。 论文运用随机行为选择策略和前馈神经网络分别解决强化学习在应用中所存在的探索问题和值函数的泛化问题。 并将两者与Q - lea rn in g 的值迭代算法结合, 共同构成基于强化学习的电梯群组调度算法。论文设计了开放的、 松耦合的算法软件结构, 定义各部分功能函数的接口,方便未来的重用; 使用M A T L A B 作为算法运行的主要环境, 提高了算法开发的快速性和调试的高效性。 结合电梯群控虚拟仿真环境进行调度算法仿真, 共4 种不同的交通流条件被用于算法的仿真与训练。 实验结果展现了算法较好的学习能力, 在与其他调度算法比较中体现了优秀的性能和对不同交通流条件的适应能力。关键词: 电梯群组调度强化学习D E D S函数逼近M D P

188宝金博页面版:关注我们

  • 新浪微博

关注188宝金博页面版公众号

188宝金博页面版
阅读
APP
阅读
返回
顶部
188宝金博页面版官网登录在线平台入口(2026已更新)—江苏协昌电子科技股份有限公司