library_name, tags, datasets, base_model
library_name tags datasets base_model
transformers
trl
dpo
argilla/ultrafeedback-binarized-preferences
meta-llama/Llama-3.2-3B-Instruct

Llama-3.2-3B-Instruct aligned using DPO on the argilla/ultrafeedback-binarized-preferences

Description
Model synced from source: MInAlA/llama3-dpo-merged
Readme 16 MiB
Languages
Jinja 100%