← Flash Papers
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
Share
Share this Flash Paper
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
https://flashpapers.ai/p/uhj2frarcp
Copy link
Post to X
Post to Bluesky
Share on LinkedIn
Submit to Hacker News
Submit to Reddit
Email a link
Source PDF ↗
Open standalone ↗
Make your own
Make your own paper
Andrew Zhao, Yiran Wu +9 more
cs.LG
2025
arXiv:2505.03335
Details ▸
Details ▴
AVG:
50.4%
· Combined OOD
CAvg:
61.6%
· OOD Coding
MAvg:
39.1%
· OOD Math
AVG:
50.4%
· Combined OOD
CAvg:
61.6%
· OOD Coding
MAvg:
39.1%
· OOD Math