← Flash Papers
Constitutional AI: Harmlessness from AI Feedback
Share
Share this Flash Paper
Constitutional AI: Harmlessness from AI Feedback
https://flashpapers.ai/p/cu9q2yctu5
Copy link
Post to X
Post to Bluesky
Share on LinkedIn
Submit to Hacker News
Submit to Reddit
Email a link
Source PDF ↗
Open standalone ↗
Make your own
Make your own paper
Yuntao Bai, Saurav Kadavath +49 more
cs.CL
2022
arXiv:2212.08073
Code
· 262★
· updated 4y ago
Details ▸
Details ▴
Harmlessness Elo Score:
180
· HHH Eval
Binary Accuracy on HHH Evaluation:
>90%
· HHH Eval
Harmlessness Elo Score:
180
· HHH Eval
Binary Accuracy on HHH Evaluation:
>90%
· HHH Eval