FP3O: Enabling Proximal Policy Optimization in Multiagent Cooperation With Parameter-Sharing Versatility
{{output}}
Existing multiagent proximal policy optimization (PPO) algorithms come at the cost of limited generalizability on different parameter-sharing configurations [e.g., full, partial, and nonparameter sharing (NoPS)] when extending the theoretical guarantee of PPO ... ...