期刊文献+
共找到71篇文章
< 1 2 4 >
每页显示 20 50 100
基于ALH-SAC算法的柑橘采摘机械臂无碰撞抓取路径规划 认领 引用
1
作者 兰玉彬 宋皓昱 +3 位作者 王莹 刘星宇 李想 黎源鸿 《农业机械学报》 EI CAS CSCD 北大核心 2026年第5期82-94,共13页
在果园等复杂农业环境中,机器人果实采摘面临枝叶遮挡、目标到达不准以及采摘效率低等技术难题。本文提出了一种基于深度强化学习的机械臂无碰撞高效抓取方法。该方法融合了基于YOLO 11的柑橘果实分类与定位的感知模型,以及基于压力传... 在果园等复杂农业环境中,机器人果实采摘面临枝叶遮挡、目标到达不准以及采摘效率低等技术难题。本文提出了一种基于深度强化学习的机械臂无碰撞高效抓取方法。该方法融合了基于YOLO 11的柑橘果实分类与定位的感知模型,以及基于压力传感器的柔性夹具压力预测模块,并改进了一种基于深度强化学习的路径规划算法Attention-LSTM-HER-SAC(ALH-SAC),以实现稳定且无损的抓取。在运动规划方面,ALH-SAC算法在软演员-评论家(SAC)框架中引入了事后经验回放(HER)、长短期记忆网络(LSTM)编码器以捕捉机械臂关节动作的时间依赖性,以及注意力编码器(Attention Encoder)以自适应聚焦关键空间特征,从而在遮挡环境下提升策略的感知能力与决策精度。设计了自定义奖励函数,引导智能体实现快速到达目标、避障及优化抓取姿态。此外,提出的混合引导机制结合启发式先验与基于笛卡尔空间线性插值的先验策略,加速了训练收敛并提升了策略鲁棒性。仿真试验结果表明,ALH-SAC的定位精度达(10.35±4.18)mm,较HER-TD3和HER-DDPG平均提升12.5 mm。果园试验进一步验证了方法的有效性,平均采摘成功率达84%,单次操作平均耗时10.58 s,充分证明了该方法在柑橘采摘场景中的有效性。 展开更多
关键词 柑橘采摘 机械臂 路径规划 SAC算法 柑橘检测 YOLO 11
暂未订购 下载PDF
基于SAC算法的混储微网观测修正自抗扰稳压策略 认领 引用
2
作者 周雪松 马培铭 +3 位作者 练继建 李苏扬 陶珑 刘晓林 《电力系统保护与控制》 EI CSCD 北大核心 2026年第7期116-128,共13页
新型电力系统中储能双向DC-DC变换器作为新能源高比例消纳的柔性枢纽,在微电网的多重不确定性影响下,面临着输出侧电压失稳风险。因此,提出一种基于柔性动作-评价(soft actor-critic,SAC)算法辅助寻优的观测修正自抗扰控制技术。首先,... 新型电力系统中储能双向DC-DC变换器作为新能源高比例消纳的柔性枢纽,在微电网的多重不确定性影响下,面临着输出侧电压失稳风险。因此,提出一种基于柔性动作-评价(soft actor-critic,SAC)算法辅助寻优的观测修正自抗扰控制技术。首先,引入二维扰动信息至待补偿项中进行扰动状态量的协同观测,同时设计迟滞函数修正微分环节的固有缺陷,从而精准重构总和扰动。随后,量化参数整定准则,并借助SAC算法的最大熵学习框架与随机策略探索,实现控制器参数在多频域扰动下的柔性匹配,使储能系统能更加充分发挥“削峰填谷”的调控作用。最后,在不同工况的仿真对比下,验证了所提策略在多种内外不确定扰动下均具备良好的动态性能。 展开更多
关键词 DC-DC变换器 混储微电网 SAC算法 迟滞函数 二维扰动
暂未订购 下载PDF
基于无人机倾斜摄影与改进SAC-IA算法的建筑实景三维建模研究 认领 引用 被引量:2
3
作者 蒋敏洁 于凯强 《自动化与仪器仪表》 2026年第2期285-288,293,共4页
为提高现有三维建模方法的精度和效率,研究提出基于无人机倾斜摄影与改进样本一致性迭代算法(Sample Consensus with Iterative Algorithm,SAC-IA)算法的三维建模方法,通过结合无人机多视角高分辨率影像采集技术,和改进SAC-IA与迭代最... 为提高现有三维建模方法的精度和效率,研究提出基于无人机倾斜摄影与改进样本一致性迭代算法(Sample Consensus with Iterative Algorithm,SAC-IA)算法的三维建模方法,通过结合无人机多视角高分辨率影像采集技术,和改进SAC-IA与迭代最近点算法协同优化点云配准过程,有效提升建筑物三维建模的精度与速度。研究方法在XX古建筑的数字修复实验中成功应用,准确恢复了建筑物的细节,包括屋顶雕花和外立面的裂缝修复,相比传统的地面激光扫描和摄影测量技术,点云配准误差减少了17%~39%。且建模效率较传统方法提高了45%。由此证明,研究方法在提高建筑三维建模精度的同时,也提升了数据采集和处理效率,为复杂建筑物和大规模场景的三维建模提供可靠且高效的解决方案。 展开更多
关键词 无人机倾斜摄影测量 实景三维建模 建筑修复 SAC-IA算法
暂未订购 下载PDF
基于改进SAC算法的多微电网经济优化调度研究 认领 引用
4
作者 赵志华 倪欢 《太阳能学报》 EI CAS CSCD 北大核心 2026年第2期355-364,共10页
针对考虑电动汽车和光伏、风电出力的多微电网系统模型,以系统总运行成本最小化为目标函数,建立起基于深度强化学习的多微电网系统经济优化调度框架,并运用改进软演员-评论家(SAC)算法的框架设计状态、动作、奖励函数和神经网络结构,通... 针对考虑电动汽车和光伏、风电出力的多微电网系统模型,以系统总运行成本最小化为目标函数,建立起基于深度强化学习的多微电网系统经济优化调度框架,并运用改进软演员-评论家(SAC)算法的框架设计状态、动作、奖励函数和神经网络结构,通过对激活函数和经验回放池的改进,提高了算法的搜索能力和防局部最优解的能力,实现了基于改进SAC算法的多微电网经济优化调度。经过仿真对比分析,该算法得到的调度策略降低了总运行成本。 展开更多
关键词 微电网 深度强化学习 优化 调度 改进SAC算法
暂未订购 下载PDF
基于改进SAC-IA与多源数据的一体化实景三维建模技术研究 认领 引用
5
作者 崔团团 高永涛 +1 位作者 唐凝 杨娟 《自动化与仪器仪表》 2026年第2期313-317,共5页
随着三维建模在城市更新、数字孪生等领域的广泛应用,为实现高效、精准的多源数据配准与建模问题。研究提出一种基于多源数据融合与改进的样本一致性初始对齐算法(Sample Consensus Initial Alignment,SAC-IA)算法的一体化三维建模方法... 随着三维建模在城市更新、数字孪生等领域的广泛应用,为实现高效、精准的多源数据配准与建模问题。研究提出一种基于多源数据融合与改进的样本一致性初始对齐算法(Sample Consensus Initial Alignment,SAC-IA)算法的一体化三维建模方法。研究通过多源坐标系统一实现空间对齐,并采用快速点特征直方图增强几何特征表达,融合曲率密度参数与Huber函数构建鲁棒配准模型。该算法在训练集和测试集上的配准适配度分别为0.93和0.89。在配准耗时方面,改进SAC-IA算法在200次迭代后平均耗时为13.3 s,显著优于对比方法。此外,在典型建模场景中,最大单点误差控制在0.045 m~0.050 m内,均方根误差最低可达0.039 m。结果表明,所提方法在精度、效率和适应性上均优于传统方法,适用于城市建模、遗产保护等复杂场景。 展开更多
关键词 三维建模 多源数据融合 SAC-IA算法 点云配准 快速点特征直方图
暂未订购 下载PDF
基于ARM-LSTM-SAC算法的机械臂柔性轴孔装配策略研究 认领 引用 被引量:1
6
作者 霍跃钦 李汝彬 +3 位作者 龚文宇 何博 王文学 刘永奎 《重型机械》 2026年第1期35-42,共8页
针对工业装配任务,尤其是不规则轴孔工件装配中,基于学习的前期样本质量低、训练过程不稳定等问题,提出一种融合引斥力模型(Attraction-Repulsion Model,ARM)引导机制和长短期记忆网络(Long Short Term Memory,LSTM)的柔性演员-评论家(S... 针对工业装配任务,尤其是不规则轴孔工件装配中,基于学习的前期样本质量低、训练过程不稳定等问题,提出一种融合引斥力模型(Attraction-Repulsion Model,ARM)引导机制和长短期记忆网络(Long Short Term Memory,LSTM)的柔性演员-评论家(Soft Actor-Critic,SAC)算法。首先,为解决训练初期探索效率低的问题,提出一种基于引斥力模型的策略引导机制,通过目标位置信息引导机械臂运动,加速收敛过程;其次,基于长短期记忆网络对算法的策略网络和价值网络进行改进,有效利用历史信息,增强策略学习能力,提高算法的收敛速度和稳定性。仿真结果表明,所提出的算法在行星减速器中心轴装配任务中取得显著的效果,装配成功率高达99.4%,与普通SAC算法相比,平均最大接触力和力矩分别降低了68.8%和79.2%。在物理环境中装配成功率达95%以上,最大接触力和力矩分别小于10 N和1.5 N·m,验证了算法的有效性。 展开更多
关键词 深度强化学习 轴孔装配 SAC算法 引斥力模型 LSTM网络
暂未订购 下载PDF
基于改进SAC算法的无人飞行器路径规划 认领 引用
7
作者 李国帅 王靖华 +1 位作者 陈丹强 陈佳东 《自动化应用》 2026年第14期24-29,共6页
针对包含静态与动态障碍的城市作战环境中无人飞行器(UAV)路径规划问题,提出一种融合人工势场(APF)奖励函数和改进经验回放的柔性演员-评论家(SAC)算法路径规划方法。首先,引入基于APF的奖励函数,同时建模目标吸引和障碍排斥,将稀疏且... 针对包含静态与动态障碍的城市作战环境中无人飞行器(UAV)路径规划问题,提出一种融合人工势场(APF)奖励函数和改进经验回放的柔性演员-评论家(SAC)算法路径规划方法。首先,引入基于APF的奖励函数,同时建模目标吸引和障碍排斥,将稀疏且以安全为核心的反馈转化为稠密且可学习的信号;其次,改进经验回放策略,将回放池内的样本划分为任务成功、危险与安全3类,并采用比例加权采样,以提升样本效率与训练的稳定性;最后,在包含动态与静态障碍的仿真环境中验证该方法。结果显示,所提方法可有效引导UAV规避障碍并到达目标点,平均成功率可达92.8%,平均碰撞率约6%;与基线SAC算法及其单项改进相比,其平均路径长度缩短23.4%,平均飞行时间缩短19.4%,且路径更平滑,表明所提方法可为城市复杂作战环境下的UAV避障与路径规划提供安全性、高效的方案。 展开更多
关键词 无人飞行器 路径规划 柔性演员-评论家算法 人工势场 经验回放 动态障碍
暂未订购 下载PDF
融入SAC算法的光储微网混合储能自驱优级联自抗扰控制 认领 引用 被引量:2
8
作者 周雪松 张宇轩 +3 位作者 马幼捷 王馨悦 陶珑 问虎龙 《电力系统保护与控制》 EI CSCD 北大核心 2025年第13期93-104,共12页
母线电压稳定是实现新能源高水平消纳的重要前提。针对光储直流微电网混合储能系统因源荷不确定性扰动导致的母线电压波动问题,提出一种融入深度强化学习柔性动作评价(soft actor-critic, SAC)算法的自驱优级联自抗扰控制策略。首先,设... 母线电压稳定是实现新能源高水平消纳的重要前提。针对光储直流微电网混合储能系统因源荷不确定性扰动导致的母线电压波动问题,提出一种融入深度强化学习柔性动作评价(soft actor-critic, SAC)算法的自驱优级联自抗扰控制策略。首先,设计了级联扩张状态观测器来实时估计和补偿系统中的不确定性扰动,以提升系统的扰动估计精度。其次,针对系统建立了马尔可夫决策模型,并设计了状态奖励与信息熵综合评估的SAC智能体,融入控制器参数优化中。通过其在线学习和经验回放实现了控制参数的自驱优整定,进一步提高了系统的抗扰性和鲁棒性。最后,通过仿真实验对比了3种控制策略在典型工况下的控制性能,验证了所提策略的有效性和优越性。 展开更多
关键词 光储直流微电网 混合储能 自抗扰控制 深度强化学习 SAC算法
暂未订购 下载PDF
一种基于改进SAC算法的六轴机械臂路径规划 认领 引用 被引量:4
9
作者 妥吉英 徐笑南 +4 位作者 李俊 张玉琛 黄安 胡都 刘梓林 《中国机械工程》 EI CAS CSCD 北大核心 2025年第12期2986-2992,共7页
为提升柔性动作-评价(SAC)算法的收敛速度及训练的稳定性,在引入优势函数与奖励聚中机制的基础上,提出一种改进SAC算法。为验证改进SAC算法的训练效果,在六轴机械臂路径规划场景中进行了仿真分析,并与深度确定性策略梯度(DDPG)算法、双... 为提升柔性动作-评价(SAC)算法的收敛速度及训练的稳定性,在引入优势函数与奖励聚中机制的基础上,提出一种改进SAC算法。为验证改进SAC算法的训练效果,在六轴机械臂路径规划场景中进行了仿真分析,并与深度确定性策略梯度(DDPG)算法、双延迟深度确定性策略梯度(TD3)算法及SAC算法进行对比。结果显示,改进SAC算法在收敛速度和稳定性上均超越DDPG、TD3与SAC算法,训练1500回合后其路径规划成功率较SAC算法提高4.8%。进一步的实验验证了改进SAC算法的规划结果在真实环境中的可行性与有效性。 展开更多
关键词 六轴机械臂 路径规划 优势函数 奖励聚中 改进SAC算法
暂未订购 下载PDF
未知环境下基于突变定位SAC算法的移动机器人路径规划 认领 引用 被引量:1
10
作者 胡立坤 韦春有 《计算机应用研究》 CSCD 北大核心 2025年第2期455-461,共7页
针对缺乏完整环境信息的条件下移动机器人局部路径规划算法性能提升及深度强化学习智能体训练速度慢的问题,提出了突变定位算法和改进的soft actor-critic(SAC)算法,并将两者结合为突变定位SAC算法。突变定位算法能够在缺乏完备环境信... 针对缺乏完整环境信息的条件下移动机器人局部路径规划算法性能提升及深度强化学习智能体训练速度慢的问题,提出了突变定位算法和改进的soft actor-critic(SAC)算法,并将两者结合为突变定位SAC算法。突变定位算法能够在缺乏完备环境信息的情况下计算子目标点位置,减少移动机器人规划路径的长度。同时,通过引入基于虚拟势场的critic网络改进损失函数和多阶段训练方法,提高SAC智能体的训练速度。实验结果表明,与DDPG、SAC、PER-SAC和HER-TD3相比,突变定位SAC算法在训练时间上分别减少了46.68%、39.50%、20.18%和27.79%。此外,突变定位SAC算法在不同环境下规划路径的长度平均减少了13.71%、10.26%、10.90%和15.89%。 展开更多
关键词 移动机器人 路径规划 深度强化学习算法 SAC算法 激光雷达 未知环境
暂未订购 下载PDF
基于SAC算法的露天煤矿无人驾驶运输车辆避障控制研究 认领 引用 被引量:2
11
作者 宋佳琛 韩硕 +1 位作者 田文明 辛守辉 《煤矿机械》 2025年第2期213-217,共5页
大部分无人驾驶车辆避障控制过程只适用于动作空间和状态空间维度较低的环境,易导致避障控制形成的运动路径过长。针对这一问题,提出了基于Soft Actor-Critic(SAC)算法的露天煤矿无人驾驶运输车辆避障控制方法。建立包含1个演员网络、2... 大部分无人驾驶车辆避障控制过程只适用于动作空间和状态空间维度较低的环境,易导致避障控制形成的运动路径过长。针对这一问题,提出了基于Soft Actor-Critic(SAC)算法的露天煤矿无人驾驶运输车辆避障控制方法。建立包含1个演员网络、2个评论家目标网络和2个评论家网络的SAC深度学习网络框架。通过SAC算法的迭代更新,对环境地图中的智能体进行不断训练,规划出最优避障路径。通过模糊PID控制器执行控制指令,实现无人驾驶运输车辆避障安全行驶控制。实验结果表明,该方法形成的车辆避障运动路径长度始终不超过60 m,显著提升了复杂环境中运输车辆的工作性能。 展开更多
关键词 SAC算法 露天煤矿 无人驾驶车辆 局部地图 避障路径 避障控制
暂未订购 下载PDF
基于PID-Lagrange-SAC的深度强化学习楼宇建筑用能行为调控策略 认领 引用
12
作者 凌䶮飞 陈涛 高赐威 《电力需求侧管理》 2025年第5期90-96,共7页
楼宇建筑的用能行为有着巨大的调节潜力,为解决此问题提出了一种基于PID-Lagrange-SAC算法的调控方法。首先,将楼宇建筑用能行为调控问题建模为马尔科夫决策过程(markov decision process,MDP)模型,将可调控设备的状态及外部变量建立为... 楼宇建筑的用能行为有着巨大的调节潜力,为解决此问题提出了一种基于PID-Lagrange-SAC算法的调控方法。首先,将楼宇建筑用能行为调控问题建模为马尔科夫决策过程(markov decision process,MDP)模型,将可调控设备的状态及外部变量建立为状态空间,可调控设备的运行功率作为决策变量,设计恰当的奖励函数以指导智能体学习较好的动作策略。为了抑制智能体违反约束条件的行为,进一步将问题建立为带约束项的马尔科夫决策过程(constrained MDP,CMDP),并将PID控制与Lagrange方法结合应用于Soft actor-critic算法进行训练。算例分析表明,最终得到的调控策略在满足用户舒适度的同时降低了楼宇建筑的运行成本及碳排放,验证了所提方法的有效性及优越性。 展开更多
关键词 楼宇建筑 用能行为调控 深度强化学习 带约束项的马尔科夫决策过程 马尔科夫决策过程算法
暂未订购 下载PDF
基于HAS-SAC算法的水下机器人路径规划方法 认领 引用
13
作者 刘家安 白雪剑 +1 位作者 汪旭 崔晓玉 《辽宁工业大学学报(自然科学版)》 2025年第6期351-358,364,共8页
针对水下机器人复杂环境下的路径规划问题,提出一种基于混合动作选择策略的HAS-SAC(hybrid-action-selection soft actor-critic,HAS-SAC)算法。首先,构建融合人工势场(artificial potential field,APF)与快速扩展随机树(rapidly-explor... 针对水下机器人复杂环境下的路径规划问题,提出一种基于混合动作选择策略的HAS-SAC(hybrid-action-selection soft actor-critic,HAS-SAC)算法。首先,构建融合人工势场(artificial potential field,APF)与快速扩展随机树(rapidly-exploring random tree,RRT)方法的协同优化混合动作选择策略,通过动态熵权系数实现专家策略与强化学习策略的渐进式融合。其次,减少传统RRT算法的无效采样区域,解决APF算法中固有的局部极小值问题,提升软演员-评论家(soft actor-critic,SAC)算法的训练收敛速度;且随着SAC策略网络的成熟,实现混合动作选择策略向自主决策模式过渡。最后,仿真对比实验表明,相较于深度确定性策略梯度(deep deterministic policy gradient,DDPG)、双延迟深度确定性策略梯度(twin delayed deep deterministic policy gradient,TD3)及SAC算法,所提HAS-SAC算法不仅收敛速度最快,且所规划路径运动距离最短、运动时间最少,综合性能具有显著优势。 展开更多
关键词 HAS-SAC算法 路径规划 强化学习 水下机器人
暂未订购 下载PDF
基于SAC算法的无人机路径规划与视频QoE研究 认领 引用 被引量:1
14
作者 刘利民 李晋峰 康云鹏 《长江信息通信》 2025年第9期198-201,210,共4页
随着无人机(UAV)技术的发展,凭借其高灵活性和快速部署能力,已成为灾后救援场景中不可或缺的工具。针对灾区复杂环境下的通信和能耗优化问题,该研究提出了一种结合动态自适应流媒体编码(DASH)技术和Soft Actor-Critic(SAC)算法的解决方... 随着无人机(UAV)技术的发展,凭借其高灵活性和快速部署能力,已成为灾后救援场景中不可或缺的工具。针对灾区复杂环境下的通信和能耗优化问题,该研究提出了一种结合动态自适应流媒体编码(DASH)技术和Soft Actor-Critic(SAC)算法的解决方案。通过联合优化视频编码参数、飞行策略及带宽资源分配,以实现在保证用户视频视频体验质量(QoE)的同时,尽可能降低UAV能耗,从而提高系统效益。仿真实验表明,相较于传统深度强化学习(DRL)算法(如DDPG、PPO),该文提出的SAC算法在收敛速度、奖励值及稳定性等方面均具有显著优势。 展开更多
关键词 无人机 深度强化学习 灾后救援 SAC算法 路径规划
暂未订购 下载PDF
AoI约束下基于SAC算法的无人机路径规划 认领 引用
15
作者 朱庆亮 郭志坚 王奇 《仪表技术》 2025年第3期73-77,共5页
无人机因其高灵活性和广覆盖能力,被广泛应用于动态场景下的信息采集。然而,现有研究多集中于静态设备场景,忽视了高移动性节点环境下的信息新鲜度(age of information, AoI)优化问题,同时无人机的有限能量限制了其在实际应用的有效性... 无人机因其高灵活性和广覆盖能力,被广泛应用于动态场景下的信息采集。然而,现有研究多集中于静态设备场景,忽视了高移动性节点环境下的信息新鲜度(age of information, AoI)优化问题,同时无人机的有限能量限制了其在实际应用的有效性。针对无人机辅助的车辆信息采集场景,提出一种基于柔性演员-评论家(soft actor-critic, SAC)算法的路径规划方法,通过优化无人机的飞行策略,平衡AoI和能效约束,引入最大熵深度强化学习框架,结合双Q网络结构和经验回放机制,在连续动作空间中实现了高效的策略学习。反复实验表明,该方法在收敛速度、奖励值和系统鲁棒性上显著优于传统强化学习算法(如DDPG和PPO),同时在复杂动态环境下有效提升了信息新鲜度和能量利用效率。 展开更多
关键词 无人机 深度强化学习 信息新鲜度 柔性演员-评论家算法 路径优化
暂未订购 下载PDF
基于自适应熵值的移动机器人无地图导航方法 认领 引用
16
作者 熊体凡 李泓辰 +2 位作者 王书亭 谢远龙 胡倚铭 《华中科技大学学报(自然科学版)》 EI CAS CSCD 北大核心 2026年第5期98-104,共7页
针对现有基于机器学习的无地图导航方法中所存在的机器人陷入局部最优后脱困能力差的问题,提出一种自适应熵值无地图导航方法.该方法首先根据机器人训练过程中的奖励波动来判定局部最优现象是否发生,然后在此基础上继续通过改进软演说... 针对现有基于机器学习的无地图导航方法中所存在的机器人陷入局部最优后脱困能力差的问题,提出一种自适应熵值无地图导航方法.该方法首先根据机器人训练过程中的奖励波动来判定局部最优现象是否发生,然后在此基础上继续通过改进软演说评论家(SAC)算法中的熵值调节机制,达到在机器人陷入局部最优后自适应改变温度系数以强化其学习能力的效果,最终促使机器人成功学习到全局最优导航策略.仿真结果表明:相比现有方法,所提方法训练得到的导航策略具备更强的脱困能力和更高的导航成功率. 展开更多
关键词 移动机器人 无地图导航 深度强化学习 局部最优 SAC算法
暂未订购 下载PDF
面向林区公路高风险路段无人机自适应巡航轨迹规划方法 认领 引用
17
作者 陈德启 张淑慧 +1 位作者 张文会 蒋贤才 《交通运输工程学报》 EI CAS CSCD 北大核心 2026年第4期121-133,共13页
为降低因森林遮蔽所引发的林区道路交通事故风险,提出了一种融合状态不确定性的深度强化学习无人机自适应巡航模型。在感知层面,设计了一种适用于林区公路场景的自适应无迹卡尔曼滤波(UKF)算法,来应对全球定位系统信号缺失;在决策层面,... 为降低因森林遮蔽所引发的林区道路交通事故风险,提出了一种融合状态不确定性的深度强化学习无人机自适应巡航模型。在感知层面,设计了一种适用于林区公路场景的自适应无迹卡尔曼滤波(UKF)算法,来应对全球定位系统信号缺失;在决策层面,构建了基于状态不确定性感知的柔性演员-评论家(SUA-SAC)算法,将UKF输出的状态估计值及其协方差作为网络输入,使SUA-SAC算法能够学习到对状态估计具有更优鲁棒性的控制策略。结果表明:在训练效率方面,SUA-SAC算法的收敛速度相较于基线SAC算法和近端策略优化算法分别提升了约50%和60%;在多场景测试中,相较于SAC算法,SUA-SAC算法在无干扰、动态遮挡和强风干扰场景下的平均跟踪误差分别降低了67%、61%和66%;在定位信号缺失达20 s的测试中,SUA-SAC算法的跟踪误差所受影响较小。SUA-SAC算法能够提高无人机在林区复杂路况下的轨迹跟踪精度、飞行稳定性以及任务成功率,有助于提升林区公路的交通安全水平。 展开更多
关键词 低空交通 交通安全 林区公路 无人机巡航 SUA-SAC算法
暂未订购 下载PDF
基于安全图强化学习的柔性互联配电网分布式电源承载力动态评估 认领 引用
18
作者 郭祚刚 郇嘉嘉 +2 位作者 白浩 刘嘉文 谈赢杰 《电力系统及其自动化学报》 CSCD 北大核心 2026年第4期95-105,共11页
针对当前基于数学优化求解方法难以动态准确评估配电网分布式电源承载力的难题,提出一种基于安全图强化学习的柔性互联配电网分布式电源承载力动态评估方法。首先,考虑智能软开关调节作用下的分布式电源动态承载力提升和网络损耗优化,... 针对当前基于数学优化求解方法难以动态准确评估配电网分布式电源承载力的难题,提出一种基于安全图强化学习的柔性互联配电网分布式电源承载力动态评估方法。首先,考虑智能软开关调节作用下的分布式电源动态承载力提升和网络损耗优化,构建适用于三相不平衡配电网的分布式电源动态承载力评估模型。其次,将分布式电源动态承载力评估模型转换为约束马尔可夫决策过程的标准范式,实现最优决策与安全动作的平衡。再次,提出内嵌图卷积神经网络的柔性动作-评价算法离线训练与在线执行方法,将图卷积神经网络嵌入柔性动作-评价算法策略网络,实现配电网分布式电源动态承载力的实时精确评估。最后,通过IEEE 33节点算例仿真,验证所提模型和方法的有效性。 展开更多
关键词 动态承载力 约束马尔可夫决策过程 图卷积神经网络 柔性动作-评价算法
暂未订购 下载PDF
面向用户移动性的VLC辅助的UAV网络能效优化(特邀) 认领 引用
19
作者 贾林琼 王梓颉 +1 位作者 汤昀霏 桂林卿 《光通信研究》 北大核心 2026年第3期13-19,共7页
【目的】在可见光通信(VLC)辅助的无人机(UAV)网络中,为满足地面用户的动态接入,UAV也需进行动态位置调整以保持与地面用户的视距(LoS)连接。因此UAV的有限机载能量需同时用于通信与飞行推进。【方法】为提升该网络的能效(EE),文章提出... 【目的】在可见光通信(VLC)辅助的无人机(UAV)网络中,为满足地面用户的动态接入,UAV也需进行动态位置调整以保持与地面用户的视距(LoS)连接。因此UAV的有限机载能量需同时用于通信与飞行推进。【方法】为提升该网络的能效(EE),文章提出了一种针对移动用户的UAV轨迹优化迭代算法。该算法迭代求解UAV最优位置和最优轨迹两个子问题,其中UAV最优位置、用户关联及功率分配可通过软演员-评论家(SAC)算法联合求解;UAV移动至下一个最优位置的轨迹功耗最小化问题可以建模为一个凸问题,并通过优化工具箱求解。【结果】数值仿真结果验证了SAC算法的收敛性,并给出了网络EE最大化的UAV位置及用户与UAV的关联情况;展示了用户动态移动下通过迭代算法得出的最优轨迹。【结论】文章所提迭代算法可以有效降低单位时间内VLC辅助的UAV网络的能耗,以此延长UAV的工作时间。 展开更多
关键词 可见光通信 无人机 能量效率 轨迹优化 软演员-评论家算法
暂未订购 下载PDF
基于改进FPFH描述子的点云初始位姿估计 认领 引用
20
作者 任伟建 刘中旭 +3 位作者 张紫汉 康朝海 霍凤财 任璐 《计算机技术与发展》 2026年第7期119-126,共8页
在机械臂装配等应用中,点云初始位姿偏差过大会导致深度学习配准模型性能不稳定。针对传统特征描述子(如FPFH)在边缘特征表述不足的问题,提出一种结合边缘点特征的改进FPFH描述子,并融合SAC-IA算法进行初始位姿估计。改进的FPFH通过提... 在机械臂装配等应用中,点云初始位姿偏差过大会导致深度学习配准模型性能不稳定。针对传统特征描述子(如FPFH)在边缘特征表述不足的问题,提出一种结合边缘点特征的改进FPFH描述子,并融合SAC-IA算法进行初始位姿估计。改进的FPFH通过提取边缘点三维坐标(x,y,z)扩充至原有33维特征中,形成36维特征向量,增强了对边缘细节的捕捉能力。实验采用斯坦福数据集和玻璃点云数据,结果显示:改进方法在China Dragon和Bunny上的配准时间较PFH减少39.2 s和23.89 s, RMSE误差分别降低0.28 mm和0.32 mm;在模拟数据缺失(局部遮挡及视角偏差)场景下,改进方法在15%数据缺失时的RMSE仍优于传统方法5.48%~15.19%。 展开更多
关键词 点云配准 初始位姿估计 FPFH描述子 边缘特征 SAC-IA算法
暂未订购 下载PDF
上一页 1 2 4 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈