251 B
251 B
library_name, tags, datasets, base_model
| library_name | tags | datasets | base_model | ||||
|---|---|---|---|---|---|---|---|
| transformers |
|
|
|
Llama-3.2-3B-Instruct aligned using DPO on the argilla/ultrafeedback-binarized-preferences