CPPO: Accelerating the Training of Group Relative Policy Optimization-Based Reasoning Models January 1, 2025· Zhihang Lin , Mingbao Lin Yuan Xie , Rongrong Ji · 0 min read URL Cite DOI Type Conference paper Publication Advances in Neural Information Processing Systems 38 publications Last updated on January 1, 2025 Authors Yuan Xie Chair Professor Fang Professor of Engineering | Chair Professor | IEEE/ACM/AAAS Fellow ← 3D Guard-Layer: An Integrated Agentic AI Safety System for Edge Artificial Intelligence January 1, 2025 Enhancing Large-Scale AI Training Efficiency: The C4 Solution for Real-Time Anomaly Detection and Communication Optimization January 1, 2025 →