RLHF / Preference Optimization
cs.LG · 2 papers
cs.CL · 2022
Aligning AI: Inside OpenAI's InstructGPT & RLHF Pipeline
API prompt distribution: 85 ± 3%Long Ouyang, Jeff Wu +18
Making language models bigger does not inherently make them better at following a user's intent. For example, large language models can generate outputs that are untruthful,…
Code· 1.3k★
Paper
GPT-4 Technical Report: An Interactive Deep Dive
MMLU: 86.4%Code· 19k★