mappo算法

Searching…

www.cnblogs.com

多智能体强化学习算法(MAPPO, Multi-Agent Proximal ...

2025年10月9日 · MAPPO通过中心化的Critic和去中心化的Actor来实现多智能体的协同训练,并采用PPO的优势来提高多智能体环境下的学习效率和稳定性。 MAPPO继承了PPO的核心思想,并结合了 …