Direct Preference Optimization (DPO) — Study Resources & PYQs
Curated resources, past papers and PYQs for Direct Preference Optimization (DPO).
Study resources
- Hugging Face Documentation (Article) — Official documentation covering Transformers, PEFT, and fine-tuning workflows for open-weight models. Background reading/viewing for: Direct Preference Optimization (DPO).