Model: MInAlA/llama3-dpo-merged Source: Original Platform
library_name, tags, datasets, base_model
| library_name | tags | datasets | base_model | ||||
|---|---|---|---|---|---|---|---|
| transformers |
|
|
|
Llama-3.2-3B-Instruct aligned using DPO on the argilla/ultrafeedback-binarized-preferences
Description
Languages
Jinja
100%