commit ab65fc4dea9ce01b9c82ba05d5974e601515ad51 Author: ModelHub XC Date: Tue Sep 1 10:38:17 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: ermiaazarkhalili/VibeThinker-3B-SFT-Fable5-Glint-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..a622561 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,38 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +vibethinker-3b-sft-fable5-glint.q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text +vibethinker-3b-sft-fable5-glint.q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text +vibethinker-3b-sft-fable5-glint.q8_0.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..250a97b --- /dev/null +++ b/README.md @@ -0,0 +1,97 @@ +--- +license: mit +base_model: + - WeiboAI/VibeThinker-3B +library_name: gguf +pipeline_tag: text-generation +tags: + - gguf + - llama.cpp + - quantized + - unsloth + - lora + - trl + - sft +--- + +# VibeThinker-3B-SFT-Fable5-Glint-GGUF + +GGUF quantizations of a LoRA fine-tune of [`WeiboAI/VibeThinker-3B`](https://huggingface.co/WeiboAI/VibeThinker-3B), supervised fine-tuned on `ermiaazarkhalili/Fable-5-Glint-Clean` (private). + +Quantized from [`ermiaazarkhalili/VibeThinker-3B-SFT-Fable5-Glint`](https://huggingface.co/ermiaazarkhalili/VibeThinker-3B-SFT-Fable5-Glint). See that repository for the full-precision weights. + +| | | +| --- | --- | +| **Base model** | [`WeiboAI/VibeThinker-3B`](https://huggingface.co/WeiboAI/VibeThinker-3B) | +| **Training data** | `ermiaazarkhalili/Fable-5-Glint-Clean` (private) | +| **Method** | LoRA supervised fine-tuning via [Unsloth](https://github.com/unslothai/unsloth) + [TRL](https://github.com/huggingface/trl) | +| **License** | `mit` (inherited from the base model) | + +## Available quantizations + +| File | Size | +| --- | --- | +| `vibethinker-3b-sft-fable5-glint.q4_k_m.gguf` | 1.93 GB | +| `vibethinker-3b-sft-fable5-glint.q5_k_m.gguf` | 2.22 GB | +| `vibethinker-3b-sft-fable5-glint.q8_0.gguf` | 3.29 GB | + +## Usage + +### llama.cpp + +```bash +huggingface-cli download ermiaazarkhalili/VibeThinker-3B-SFT-Fable5-Glint-GGUF vibethinker-3b-sft-fable5-glint.q4_k_m.gguf --local-dir . +llama-cli -m vibethinker-3b-sft-fable5-glint.q4_k_m.gguf -p "Explain gradient checkpointing in two sentences." -n 256 +``` + +### Ollama + +```bash +echo 'FROM ./vibethinker-3b-sft-fable5-glint.q4_k_m.gguf' > Modelfile +ollama create vibethinker-3b-sft-fable5-glint-gguf -f Modelfile +ollama run vibethinker-3b-sft-fable5-glint-gguf +``` + +## Training configuration + +| Setting | Value | +| --- | --- | +| LoRA rank (r) | 16 | +| LoRA alpha | 16 | +| Learning rate | 0.0002 | +| Epochs | 3 | +| Effective batch size | 8 (2 x 4 grad accum) | +| Max sequence length | 4096 | +| Base precision | 4-bit (QLoRA) | +| Target modules | `q_proj`, `k_proj`, `v_proj`, `o_proj`, `gate_proj`, `up_proj`, `down_proj` | + +## Observed training loss + +Measured from our SLURM logs for this configuration. These are training-loss +observations only — no downstream benchmark evaluation has been run on this +model, so they should not be read as a quality claim. + +| SLURM job | Steps | First loss | Final loss | +| --- | --- | --- | --- | +| `45987994` | 1,554 | 3.3731 | 1.1936 | +| `46021015` | 1,554 | 3.3731 | 1.1904 | + +## Limitations + +- No benchmark evaluation has been run on this checkpoint. The only reported + numbers are training-loss observations. +- Inherits the biases, knowledge cutoff and failure modes of the base model. +- Fine-tuned on a single instruction-following dataset; behaviour outside that + distribution is untested. +- LoRA adapters were merged into the base weights, so the merged model cannot + be detached from this fine-tune. + +## Reproducing + +Trained by `notebooks/fable_distillation_vibethinker-3b_fable-glint_unsloth.ipynb`, executed non-interactively with +papermill on a SLURM H100 partition (Unsloth + TRL, LoRA). + +--- + +*Card generated from the training run's own configuration and logs by* +*`scripts/generate_hub_model_card.py`.* diff --git a/vibethinker-3b-sft-fable5-glint.q4_k_m.gguf b/vibethinker-3b-sft-fable5-glint.q4_k_m.gguf new file mode 100644 index 0000000..ba5f7f9 --- /dev/null +++ b/vibethinker-3b-sft-fable5-glint.q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c050468abb63efdf5bc6d2048fd4affa798881c61a15eb8801a60d63935a0894 +size 1929902176 diff --git a/vibethinker-3b-sft-fable5-glint.q5_k_m.gguf b/vibethinker-3b-sft-fable5-glint.q5_k_m.gguf new file mode 100644 index 0000000..d6fdb82 --- /dev/null +++ b/vibethinker-3b-sft-fable5-glint.q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:84a4c48d0813b51a463a7942237a7286e756403aaf8bf463e7ccf7dbdcac6546 +size 2224814176 diff --git a/vibethinker-3b-sft-fable5-glint.q8_0.gguf b/vibethinker-3b-sft-fable5-glint.q8_0.gguf new file mode 100644 index 0000000..8266bd9 --- /dev/null +++ b/vibethinker-3b-sft-fable5-glint.q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ed8fa229bcc8ad218b5c58728f99a1d9419556395e8d5c48311acd951df87b32 +size 3285475424