简介概要

基于强化学习的煤矸石分拣机械臂智能控制算法研究

来源期刊：工矿自动化2021年第1期

论文作者：张永超于智伟丁丽林

文章页码：36 - 42

关键词：选煤;煤矸石分拣;分拣机器人;机械臂;关节角状态控制;强化学习;奖励函数;DDPG算法;

摘要：针对传统煤矸石分拣机械臂控制算法如抓取函数法、基于费拉里法的动态目标抓取算法等依赖于精确的环境模型、且控制过程缺乏自适应性,传统深度确定性策略梯度（DDPG）等智能控制算法存在输出动作过大及稀疏奖励容易被淹没等问题,对传统DDPG算法中的神经网络结构和奖励函数进行了改进,提出了一种适合处理六自由度煤矸石分拣机械臂的基于强化学习的改进DDPG算法。煤矸石进入机械臂工作空间后,改进DDPG算法可根据相应传感器返回的煤矸石位置及机械臂状态进行决策,并向相应运动控制器输出一组关节角状态控制量,根据煤矸石位置及关节角状态控制量控制机械臂运动,使机械臂运动到煤矸石附近,实现煤矸石分拣。仿真实验结果表明:改进DDPG算法相较于传统DDPG算法具有无模型通用性强及在与环境交互中可自适应学习抓取姿态的优势,可率先收敛于探索过程中所遇的最大奖励值,利用改进DDPG算法控制的机械臂所学策略泛化性更好、输出的关节角状态控制量更小、煤矸石分拣效率更高。

详情信息展示

基于强化学习的煤矸石分拣机械臂智能控制算法研究

张永超，于智伟，丁丽林

山东科技大学机械电子工程学院

摘要：针对传统煤矸石分拣机械臂控制算法如抓取函数法、基于费拉里法的动态目标抓取算法等依赖于精确的环境模型、且控制过程缺乏自适应性,传统深度确定性策略梯度（DDPG）等智能控制算法存在输出动作过大及稀疏奖励容易被淹没等问题,对传统DDPG算法中的神经网络结构和奖励函数进行了改进,提出了一种适合处理六自由度煤矸石分拣机械臂的基于强化学习的改进DDPG算法。煤矸石进入机械臂工作空间后,改进DDPG算法可根据相应传感器返回的煤矸石位置及机械臂状态进行决策,并向相应运动控制器输出一组关节角状态控制量,根据煤矸石位置及关节角状态控制量控制机械臂运动,使机械臂运动到煤矸石附近,实现煤矸石分拣。仿真实验结果表明:改进DDPG算法相较于传统DDPG算法具有无模型通用性强及在与环境交互中可自适应学习抓取姿态的优势,可率先收敛于探索过程中所遇的最大奖励值,利用改进DDPG算法控制的机械臂所学策略泛化性更好、输出的关节角状态控制量更小、煤矸石分拣效率更高。

关键词：选煤;煤矸石分拣;分拣机器人;机械臂;关节角状态控制;强化学习;奖励函数;DDPG算法;

<上一页 1 下一页 >

相关论文

基于机器视觉的多机械臂煤矸石分拣机器人系统研究

基于余弦定理-PID的煤矸石分拣机器人动态目标稳准抓取算法

双臂并联煤矸石分拣机器人及其轨迹规划研究

基于强化学习的机械臂避碰研究

基于深度强化学习的机械臂避障路径规划研究

基于EAIDK的智能煤矸分拣系统设计

基于多机械臂协同的煤矸分拣方法研究

面向煤矸分拣机器人的多机械臂协同策略

基于神经网络的机械臂的模仿学习研究

一种改进型机器智能强化学习机制研究

相关知识点

机械臂旋转装置

隧道凿岩机器人机械臂运动学研究

机械臂——钻臂的定位机构

机械臂工作任务规划时的优化指标

支持向量机及学习算法

机器学习遗传算法的应用情况

隧道凿岩机器人任务规划系统结构设计

湖南目前煤矸石资源开发利用实际状况

机械原理的学习要点

热风炉智能控制系统

计算智能及应用

有色金属在线官网 | 会议 | 在线投稿 | 购买纸书 | 科技图书馆

中南大学出版社技术支持版权声明电话：0731-88830515 88830516 传真：0731-88710482 Email:administrator@cnnmol.com

互联网出版许可证：（署）网出证（京）字第342号京ICP备17050991号-6 京公网安备11010802042557号