← Flash Papers
Tülu 3: Pushing Frontiers in Open Language Model Post-Training
Share
Share this Flash Paper
Tülu 3: Pushing Frontiers in Open Language Model Post-Training
https://flashpapers.ai/p/eghngnwk26
Copy link
Post to X
Post to Bluesky
Share on LinkedIn
Submit to Hacker News
Submit to Reddit
Email a link
Source PDF ↗
Open standalone ↗
Make your own
Make your own paper
Nathan Lambert, Jacob Morrison +21 more
cs.CL
2024
arXiv:2411.15124
Code
· 3.7k★
· updated 1mo ago
Details ▸
Details ▴
GSM8K:
87.6%
· GSM8K
HumanEval:
83.9%
· HumanEval
IFEval:
82.4%
· IFEval
Safety Average:
85.5%
· Safety Multi-task
GSM8K:
87.6%
· GSM8K
HumanEval:
83.9%
· HumanEval
IFEval:
82.4%
· IFEval
Safety Average:
85.5%
· Safety Multi-task
Concepts:
Direct Preference Optimization