期刊导航
期刊开放获取
上海教育软件发展有限公..
期刊文献
+
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
任意字段
题名或关键词
题名
关键词
文摘
作者
第一作者
机构
刊名
分类号
参考文献
作者简介
基金资助
栏目信息
检索
高级检索
期刊导航
共找到
1
篇文章
<
1
>
每页显示
20
50
100
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
显示方式:
文摘
详细
列表
相关度排序
被引量排序
时效性排序
具有精英策略的深度强化学习无人机集群通信网络拓扑设计
被引量:
9
1
作者
董方昊
冯有前
+3 位作者
尹忠海
梁晓龙
周诚
李明杰
《空军工程大学学报(自然科学版)》
CSCD
北大核心
2019年第4期52-58,共7页
针对集群无人机背景下定向天线网络拓扑设计的NP-hard特点,基于网络高抗毁、低功耗、高稳定性等要求,以抗毁性(3-连通)、链路量、链路功耗和稳定性为奖励,提出了一种具有精英策略的深度强化学习通信网络拓扑生成算法,验证了精英经验池...
针对集群无人机背景下定向天线网络拓扑设计的NP-hard特点,基于网络高抗毁、低功耗、高稳定性等要求,以抗毁性(3-连通)、链路量、链路功耗和稳定性为奖励,提出了一种具有精英策略的深度强化学习通信网络拓扑生成算法,验证了精英经验池加速训练效果。与传统DQN相比,引入精英经验池能够有效加速模型收敛,训练时间减少3倍以上。与遗传算法相比,算法分离了训练与使用过程,当网络训练完成后,能够根据场景需要实时计算通信网络拓扑。实验阶段设计了随机给定空间位置的6节点、10节点、24节点和36节点的3-连通通信网络拓扑。实验结果表明:所提算法具有强的实时性和适用性,对于不大于36节点的网络,可在183 ms内实现网络拓扑的更新计算,达到了实际应用的实时性要求。
展开更多
关键词
深
度
强化学习
精英经验池
通信网络连通度
通信
网络
拓扑
在线阅读
下载PDF
职称材料
题名
具有精英策略的深度强化学习无人机集群通信网络拓扑设计
被引量:
9
1
作者
董方昊
冯有前
尹忠海
梁晓龙
周诚
李明杰
机构
空军工程大学基础部
空军工程大学空管领航学院
出处
《空军工程大学学报(自然科学版)》
CSCD
北大核心
2019年第4期52-58,共7页
基金
国家自然科学基金(61472443)
文摘
针对集群无人机背景下定向天线网络拓扑设计的NP-hard特点,基于网络高抗毁、低功耗、高稳定性等要求,以抗毁性(3-连通)、链路量、链路功耗和稳定性为奖励,提出了一种具有精英策略的深度强化学习通信网络拓扑生成算法,验证了精英经验池加速训练效果。与传统DQN相比,引入精英经验池能够有效加速模型收敛,训练时间减少3倍以上。与遗传算法相比,算法分离了训练与使用过程,当网络训练完成后,能够根据场景需要实时计算通信网络拓扑。实验阶段设计了随机给定空间位置的6节点、10节点、24节点和36节点的3-连通通信网络拓扑。实验结果表明:所提算法具有强的实时性和适用性,对于不大于36节点的网络,可在183 ms内实现网络拓扑的更新计算,达到了实际应用的实时性要求。
关键词
深
度
强化学习
精英经验池
通信网络连通度
通信
网络
拓扑
Keywords
deep reinforcement learning
elite experience pool
connectivity
communication network topology
分类号
V279 [航空宇航科学与技术—飞行器设计]
TN915.0 [电子电信—通信与信息系统]
在线阅读
下载PDF
职称材料
题名
作者
出处
发文年
被引量
操作
1
具有精英策略的深度强化学习无人机集群通信网络拓扑设计
董方昊
冯有前
尹忠海
梁晓龙
周诚
李明杰
《空军工程大学学报(自然科学版)》
CSCD
北大核心
2019
9
在线阅读
下载PDF
职称材料
已选择
0
条
导出题录
引用分析
参考文献
引证文献
统计分析
检索结果
已选文献
上一页
1
下一页
到第
页
确定
用户登录
登录
IP登录
使用帮助
返回顶部