Fine-tuning LLMs with RLHF
Fine-tuning large language models using reinforcement learning with human feedback.
Penn State, Nov 2023 onwards
Ongoing research on fine-tuning large language models using reinforcement learning with human feedback (RLHF). More details to come.