Review
Open access
Jun 2026
Proximal Policy Optimization in 5G, B5G, and 6G Communication Systems: A Systematic Review
According to this study, PPO provides continuous action spaces with good training stability for AI models and its stable policy-learning capabilities make it suitable for next-generation communication systems.
Vijaya Kittu Manda, Bhukya Madhu, Theodore Tarnanidis
· Future Internet · 0 citations