Fine-tuning LLMs with RLHF

Fine-tuning large language models using reinforcement learning with human feedback.

Penn State, Nov 2023 onwards

Ongoing research on fine-tuning large language models using reinforcement learning with human feedback (RLHF). More details to come.