commit 4b8f9e781c1a7b2c8a9bfaa6145a9bfde2d2cecb Author: ModelHub XC Date: Sun Aug 9 10:51:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: afrideva/zephyr-smol_llama-100m-sft-full-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..90b31ec --- /dev/null +++ b/.gitattributes @@ -0,0 +1,42 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.fp16.gguf filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.q2_k.gguf filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.q3_k_m.gguf filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.q6_k.gguf filter=lfs diff=lfs merge=lfs -text +zephyr-smol_llama-100m-sft-full.q8_0.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..65531eb --- /dev/null +++ b/README.md @@ -0,0 +1,93 @@ +--- +base_model: amazingvince/zephyr-smol_llama-100m-sft-full +inference: false +license: apache-2.0 +model-index: +- name: zephyr-smol_llama-100m-sft-full + results: [] +model_creator: amazingvince +model_name: zephyr-smol_llama-100m-sft-full +pipeline_tag: text-generation +quantized_by: afrideva +tags: +- generated_from_trainer +- gguf +- ggml +- quantized +- q2_k +- q3_k_m +- q4_k_m +- q5_k_m +- q6_k +- q8_0 +--- +# amazingvince/zephyr-smol_llama-100m-sft-full-GGUF + +Quantized GGUF model files for [zephyr-smol_llama-100m-sft-full](https://huggingface.co/amazingvince/zephyr-smol_llama-100m-sft-full) from [amazingvince](https://huggingface.co/amazingvince) + + +| Name | Quant method | Size | +| ---- | ---- | ---- | +| [zephyr-smol_llama-100m-sft-full.fp16.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.fp16.gguf) | fp16 | 204.25 MB | +| [zephyr-smol_llama-100m-sft-full.q2_k.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.q2_k.gguf) | q2_k | 51.90 MB | +| [zephyr-smol_llama-100m-sft-full.q3_k_m.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.q3_k_m.gguf) | q3_k_m | 58.04 MB | +| [zephyr-smol_llama-100m-sft-full.q4_k_m.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.q4_k_m.gguf) | q4_k_m | 66.38 MB | +| [zephyr-smol_llama-100m-sft-full.q5_k_m.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.q5_k_m.gguf) | q5_k_m | 75.31 MB | +| [zephyr-smol_llama-100m-sft-full.q6_k.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.q6_k.gguf) | q6_k | 84.80 MB | +| [zephyr-smol_llama-100m-sft-full.q8_0.gguf](https://huggingface.co/afrideva/zephyr-smol_llama-100m-sft-full-GGUF/resolve/main/zephyr-smol_llama-100m-sft-full.q8_0.gguf) | q8_0 | 109.33 MB | + + + +## Original Model Card: + + +# zephyr-smol_llama-100m-sft-full + +This model is a fine-tuned version of [BEE-spoke-data/smol_llama-101M-GQA](https://huggingface.co/BEE-spoke-data/smol_llama-101M-GQA) on an unknown dataset. +It achieves the following results on the evaluation set: +- Loss: 1.9579 + +## Model description + +More information needed + +## Intended uses & limitations + +More information needed + +## Training and evaluation data + +More information needed + +## Training procedure + +### Training hyperparameters + +The following hyperparameters were used during training: +- learning_rate: 2e-05 +- train_batch_size: 16 +- eval_batch_size: 16 +- seed: 42 +- distributed_type: multi-GPU +- num_devices: 2 +- gradient_accumulation_steps: 4 +- total_train_batch_size: 128 +- total_eval_batch_size: 32 +- optimizer: Adam with betas=(0.9,0.999) and epsilon=1e-08 +- lr_scheduler_type: cosine +- num_epochs: 1 + +### Training results + +| Training Loss | Epoch | Step | Validation Loss | +|:-------------:|:-----:|:----:|:---------------:| +| 1.9642 | 0.7 | 1141 | 1.9578 | + + +### Framework versions + +- Transformers 4.35.0 +- Pytorch 2.1.0 +- Datasets 2.14.6 +- Tokenizers 0.14.1 \ No newline at end of file diff --git a/zephyr-smol_llama-100m-sft-full.fp16.gguf b/zephyr-smol_llama-100m-sft-full.fp16.gguf new file mode 100644 index 0000000..ebc3b7e --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.fp16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a98d178ce7f60aa06a47a556c51e700ee560789c6093dbb4d5251194502db6ee +size 204250656 diff --git a/zephyr-smol_llama-100m-sft-full.q2_k.gguf b/zephyr-smol_llama-100m-sft-full.q2_k.gguf new file mode 100644 index 0000000..80fe10f --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.q2_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:63843f545ec0cb70025bf2eca96efcd38e86063f69d58ebf0e04b2a048af219e +size 51904832 diff --git a/zephyr-smol_llama-100m-sft-full.q3_k_m.gguf b/zephyr-smol_llama-100m-sft-full.q3_k_m.gguf new file mode 100644 index 0000000..daf1dd1 --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.q3_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8a795a482c85cef6a1e7fdd263355f3a95e3c685439a2e04ca6f9cbac61d6660 +size 58035776 diff --git a/zephyr-smol_llama-100m-sft-full.q4_k_m.gguf b/zephyr-smol_llama-100m-sft-full.q4_k_m.gguf new file mode 100644 index 0000000..3800d43 --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:29ad2035c12439ad8341510ac594fd29ce96fb6817e0f9823b30ebd03099cb88 +size 66378560 diff --git a/zephyr-smol_llama-100m-sft-full.q5_k_m.gguf b/zephyr-smol_llama-100m-sft-full.q5_k_m.gguf new file mode 100644 index 0000000..5a89104 --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:135461a948912a9f3ce7fa80da22ba9a2d88dd8c7c75d226d28e3049e4704e4e +size 75311936 diff --git a/zephyr-smol_llama-100m-sft-full.q6_k.gguf b/zephyr-smol_llama-100m-sft-full.q6_k.gguf new file mode 100644 index 0000000..4d6a276 --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.q6_k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:78bc6922f8968890a1f0e52ec67d6e8e4206d3d63ab994f0509e848b7a4e397f +size 84803648 diff --git a/zephyr-smol_llama-100m-sft-full.q8_0.gguf b/zephyr-smol_llama-100m-sft-full.q8_0.gguf new file mode 100644 index 0000000..24a507c --- /dev/null +++ b/zephyr-smol_llama-100m-sft-full.q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d9112b73198922558fe870c853bce9486f5e7638e58e29e482297382002c61dd +size 109325888