← Flash Papers
Does RL Really Expand LLM Reasoning?
Share
Share this Flash Paper
Does RL Really Expand LLM Reasoning?
https://flashpapers.ai/p/5we2237yez
Copy link
Post to X
Post to Bluesky
Share on LinkedIn
Submit to Hacker News
Submit to Reddit
Email a link
Source PDF ↗
Open standalone ↗
Make your own
Make your own paper
Yang Yue, Zhiqi Chen +6 more
cs.AI
2025
arXiv:2504.13837
Code
Details ▸
Details ▴
Omni-MATH-Train Pass@1:
42.5%
· Omni-MATH-Train
Omni-MATH-Train Pass@256:
64.3%
· Omni-MATH-Train
MATH500 Pass@1 (GRPO):
76.3%
· MATH500
MATH500 Pass@256 (GRPO):
95.4%
· MATH500
Omni-MATH-Train Pass@1:
42.5%
· Omni-MATH-Train
Omni-MATH-Train Pass@256:
64.3%
· Omni-MATH-Train
MATH500 Pass@1 (GRPO):
76.3%
· MATH500
MATH500 Pass@256 (GRPO):
95.4%
· MATH500
Concepts:
GRPO