Model: MInAlA/Qwen3-4B-Instruct-2507-DPO-merged Source: Original Platform
library_name, tags, datasets, base_model
| library_name | tags | datasets | base_model | ||||
|---|---|---|---|---|---|---|---|
| transformers |
|
|
|
Qwen3-4B-Instruct-2507 aligned using DPO on the argilla/ultrafeedback-binarized-preferences
Description
Languages
Jinja
100%