← Flash Papers
DAPO: Demystifying Large-Scale LLM Reinforcement Learning
Share
Share this Flash Paper
DAPO: Demystifying Large-Scale LLM Reinforcement Learning
https://flashpapers.ai/p/vztjrtkjz6
Copy link
Post to X
Post to Bluesky
Share on LinkedIn
Submit to Hacker News
Submit to Reddit
Email a link
Source PDF ↗
Open standalone ↗
Make your own
Make your own paper
Qiying Yu, Zheng Zhang +33 more
cs.LG
2025
arXiv:2503.14476
Code
· 22k★
· updated 1mo ago
Details ▸
Details ▴
AIME 2024 Accuracy:
50.0%
· AIME 2024
Training Step Efficiency:
50% fewer steps
· AIME 2024
AIME 2024 Accuracy:
50.0%
· AIME 2024
Training Step Efficiency:
50% fewer steps
· AIME 2024
DAPO: Demystifying Large-Scale LLM Reinforcement Learning — Flash Papers