Files
llama3-dpo-merged/README.md

12 lines
251 B
Markdown
Raw Normal View History

---
library_name: transformers
tags:
- trl
- dpo
datasets:
- argilla/ultrafeedback-binarized-preferences
base_model:
- meta-llama/Llama-3.2-3B-Instruct
---
Llama-3.2-3B-Instruct aligned using DPO on the ``argilla/ultrafeedback-binarized-preferences``