plant
这个作者很懒,什么都没留下…
展开
专栏收录文章
- 默认排序
- 最新发布
- 最早发布
- 最多阅读
- 最少阅读
-
18、基于拥塞博弈的插电式混合动力汽车(PHEV)路径选择强化学习
本文研究了基于拥塞博弈的插电式混合动力汽车(PHEV)路径选择强化学习方法。通过将路径选择问题建模为拥塞博弈,结合强化学习和学习自动机技术,提出了一种分布式路径选择策略。在完全信息和不完全信息情况下,分别设计了基于拉格朗日乘数法和B-M强化学习(RL)方案的优化算法,并证明了最优路径选择策略的存在唯一性和B-M RL方案的收敛性。研究成果为PHEV在交通网络中的路径优化提供了理论支持和实用方法,有助于提升交通效率并降低能源消耗。原创 2025-08-24 09:24:38 · 78 阅读 · 0 评论 -
17、强化学习在受限博弈与插电式混合动力汽车路线选择中的应用
本博文探讨了强化学习在受限博弈与插电式混合动力汽车(PHEV)路线选择中的应用。在受限能源交易博弈中,通过双重拍卖机制和自适应学习算法,优化交易数量和效用,证明了混合策略纳什均衡的存在性和唯一性,并设计了收敛到均衡点的学习算法。在PHEV路线选择部分,引入Bush-Mosteller(B-M RL)强化学习方案,将拥塞博弈的纳什均衡问题转化为交通分配问题(TAP),并提出分布式算法求解,确保算法收敛到最优解。研究展示了强化学习在能源市场和交通系统中的广泛应用前景,并提出了未来发展方向。原创 2025-08-23 12:34:43 · 56 阅读 · 0 评论 -
16、不完全信息约束博弈的强化学习
本文探讨了不完全信息约束博弈中纳什均衡的存在性与唯一性,并设计了基于布什-莫斯特勒(B-M)强化学习方案的算法,以实现玩家策略向纳什均衡的收敛。通过引入拉格朗日乘数法和正则化项,解决了约束优化问题并保证均衡的唯一性。文章结合理论分析与算法设计,为能源交易等非合作博弈实际问题提供了有效的方法支持。原创 2025-08-22 14:49:29 · 64 阅读 · 0 评论 -
15、基于强化学习的不完全信息约束博弈在能源交易中的应用
本文研究了基于强化学习的不完全信息约束博弈在能源交易中的应用。通过构建智能电网模型和双向拍卖机制,提出了混合策略纳什均衡(NE)的概念,并证明了其存在性与唯一性。同时,设计了一种自适应学习算法以寻找该均衡,并通过收敛性分析确保了策略的长期稳定性和有效性。研究结果对于优化能源交易市场、提高能源利用效率具有重要的理论和实践意义。原创 2025-08-21 11:33:33 · 82 阅读 · 0 评论 -
14、智能微电网能源交易博弈中的强化学习算法
本文探讨了在智能微电网能源交易博弈中应用强化学习算法(如FALA和CALA)来寻找最优策略的问题。通过设计学习算法,帮助微电网在不完全信息的情况下最大化平均效用,并结合双拍卖模型和纳什均衡理论,验证了算法的有效性。同时,文章还对算法性能进行了对比分析,并展望了未来研究方向,包括引入更多实际约束和优化拍卖机制等。原创 2025-08-20 13:05:52 · 54 阅读 · 0 评论 -
13、智能微电网能源交易博弈中的强化学习
本文研究了在不完全信息下智能微电网中的能源交易博弈问题,并提出了一种基于强化学习的学习自动机(LA)方法。通过将能源交易问题建模为Stackelberg博弈,文章探讨了离散和连续策略空间中平均效用最大化与最佳策略求解的等价关系。为此,设计了有限动作学习自动机(FALA)和连续动作学习自动机(CALA)两种算法,分别适用于有限动作集和连续动作空间场景。文章还通过数值案例验证了算法的有效性,并总结了其在智能微电网能源交易中的应用前景。原创 2025-08-19 14:05:51 · 71 阅读 · 0 评论 -
12、随机梯度推动经济调度与强化学习在智能微电网能源交易中的应用
本博文探讨了随机梯度推动方法在经济调度问题中的应用以及强化学习在智能微电网能源交易游戏中的作用。通过理论分析和模拟实验,验证了算法在时变有向通信网络中解决经济调度的有效性,并证明了强凸函数的收敛速度提升。同时,提出了两种基于学习自动机的算法以寻找纳什均衡,并通过数值例子验证其有效性,为智能微电网的能源交易提供了新的解决方案。原创 2025-08-18 12:46:13 · 55 阅读 · 0 评论 -
11、时变有向图上经济调度的随机梯度推送方法
本文提出了一种基于随机梯度推送方法的分布式优化算法,用于解决时变有向网络上的经济调度问题。通过引入异步步长和噪声梯度处理,算法能够在存在通信延迟和噪声干扰的情况下保持良好的收敛性能。文章详细介绍了问题模型、算法设计、收敛性分析,并讨论了其在智能电网和微电网中的应用潜力。原创 2025-08-17 16:09:29 · 72 阅读 · 0 评论 -
10、分布式优化算法在经济调度问题中的应用与分析
本文探讨了分布式优化算法在电力系统经济调度问题(EDP)中的应用与性能分析。文章从算法的收敛性出发,结合多个案例研究,验证了算法在不同网络环境下的有效性。重点介绍了基于随机梯度推送的分布式优化算法,其在异步步长、噪声梯度、不同凸性成本函数以及时变有向通信网络中的鲁棒性表现。通过案例对比分析,展示了DPD-PD算法相较于传统方法的优越收敛性能。最后,文章总结了算法的优势,并展望了未来的研究方向。原创 2025-08-16 12:48:30 · 103 阅读 · 0 评论 -
9、时变有向图上约束优化的线性收敛算法
本文研究了时变有向不平衡网络下的约束优化问题,并提出了一种具有线性收敛性的分布式原始-对偶推-DIGing算法(DPD-PD)。该算法结合了推和方法与不精确梯度跟踪,能够在仅与入邻节点交互的情况下实现分布式执行,显著减少了信息传输量,适用于大规模时变网络。通过严格的理论分析,文章证明了算法的线性收敛性,并讨论了参数选择对收敛速率的影响。此外,还比较了DPD-PD与其他优化算法的适用性与性能差异,并提出了未来的研究方向,如参数优化、网络动态性处理以及多目标优化的扩展。原创 2025-08-15 10:02:20 · 81 阅读 · 0 评论 -
8、分布式优化算法:收敛分析与应用
本文探讨了分布式优化算法的收敛性分析及其在实际问题中的应用。重点介绍了一种新的分布式原始-对偶推-DIGing算法(DPD-PD),该算法能够处理具有耦合等式约束和局部不等式约束的问题,并适用于时变有向不平衡网络。通过数值实验验证了算法的性能,并与其他算法进行了比较,结果表明DPD-PD在收敛速度和准确性方面具有优势。文章还总结了分布式优化算法的研究背景、发展现状及未来研究方向。原创 2025-08-14 14:52:09 · 80 阅读 · 0 评论 -
7、随机矩阵有向图上的加速分布式优化
本文提出了一种适用于有向图的线性分布式优化算法,用于解决多智能体系统中最小化聚合函数的问题。该算法结合了行随机和列随机矩阵,无需双随机矩阵或特征向量估计,降低了通信和计算负担。在局部目标函数具有Lipschitz连续梯度且为强凸函数的条件下,该算法以恒定步长线性收敛到全局最优解。通过理论分析和实验验证,证明了算法的收敛性和优越性能,并探讨了其在机器学习、传感器网络和智能电网等领域的应用前景。原创 2025-08-13 13:34:02 · 74 阅读 · 0 评论 -
6、不等式约束与随机投影下的分布式优化
本文研究了在全局凸不等式约束和随机出现的局部凸状态约束下,分布式多智能体系统的优化问题。通过设计一种原始-对偶随机投影次梯度算法,并结合递减步长策略,分析了算法的几乎必然收敛性。基于超鞅收敛引理和一系列数学推导,证明了在满足步长条件的情况下,所有代理能够收敛到共同的最优解。数值示例验证了算法的有效性,并展示了其在实际问题中的应用潜力。研究结果为处理复杂约束下的分布式优化问题提供了理论支持和技术参考。原创 2025-08-12 12:38:20 · 61 阅读 · 0 评论 -
5、不等式约束与随机投影下的分布式优化
本文提出了一种分布式原始-对偶随机投影次梯度(DPDRPS)算法,用于解决具有全局凸不等式约束和随机出现的局部凸状态约束集的分布式多智能体凸优化问题。该算法结合了次梯度下降、局部时变加权平均和随机投影步骤,并在递减步长条件下证明了其几乎必然收敛性。通过数值实验验证了算法的有效性,展示了其在多智能体网络中的优化性能和收敛特性。原创 2025-08-11 11:13:31 · 55 阅读 · 0 评论 -
4、多智能体系统的约束一致性研究
本研究聚焦于异步多智能体系统的约束一致性问题,其中每个智能体的状态需保持在封闭凸约束集内,通信图是有向且动态变化的。通过分析智能体的状态更新方程与状态转移矩阵的性质,结合投影误差收敛性证明、辅助变量的引入以及数值示例验证,系统地探讨了多智能体系统达成约束一致性的理论框架与实际应用价值。研究结果表明,所提出的方法在简单有向和大规模有向多智能体系统中均能有效实现约束一致性,为协同控制提供了理论支持和技术指导。原创 2025-08-10 13:09:49 · 71 阅读 · 0 评论 -
3、多智能体系统中的分布式优化与约束共识
本博文探讨了多智能体系统中的分布式优化与约束共识问题。针对通信延迟问题,提出了带延迟次梯度的DDA算法,并通过模拟验证了其在收敛速度上的优势。同时,研究了异步离散时间多智能体系统的约束共识问题,通过模型转换将异步问题转化为同步问题,并采用分布式异步投影算法分离线性和非线性部分,分析投影误差对系统共识的影响。最终通过数值示例验证了方法的有效性。研究为多智能体系统在复杂通信环境和约束条件下的应用奠定了基础。原创 2025-08-09 13:01:00 · 78 阅读 · 0 评论 -
2、具有延迟的多智能体网络中的合作分布式优化
本文研究了具有延迟的多智能体网络中的合作分布式优化问题,提出了基于延迟次梯度的分布式对偶平均(DDA)算法。通过严格的数学分析,建立了算法收敛速度与网络拓扑结构之间的关系,特别是与通信图谱间隙的联系。文中给出了算法的收敛性证明,并在不同类型的网络拓扑下分析了其收敛速度。最后,通过在支持向量机(SVM)问题上的数值实验验证了算法的有效性。原创 2025-08-08 13:40:09 · 65 阅读 · 0 评论 -
1、分布式多智能体网络中的协同优化:应对延迟挑战
本文探讨了在分布式多智能体网络中处理延迟情况下的协同优化问题,提出了基于对偶平均更新和延迟次梯度信息的算法,能够有效解决分布式非光滑最小化问题。通过理论分析和数值实验,验证了该算法在收敛速率和应对延迟方面的优势,并讨论了其在电力系统、传感器网络、智能建筑和智能制造等领域的应用前景。原创 2025-08-07 10:37:01 · 72 阅读 · 0 评论
分享