初始化项目,由ModelHub XC社区提供模型

Model: mradermacher/medico-llama-3.2-1b-ver-2-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-09-12 09:08:15 +08:00
commit 6e10731391
14 changed files with 159 additions and 0 deletions

47
.gitattributes vendored Normal file
View File

@@ -0,0 +1,47 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
medico-llama-3.2-1b-ver-2.f16.gguf filter=lfs diff=lfs merge=lfs -text

76
README.md Normal file
View File

@@ -0,0 +1,76 @@
---
base_model: sazuyakun/medico-llama-3.2-1b-ver-2
language:
- en
library_name: transformers
license: apache-2.0
mradermacher:
readme_rev: 1
quantized_by: mradermacher
tags:
- text-generation-inference
- transformers
- unsloth
- llama
- trl
- sft
---
## About
<!-- ### quantize_version: 2 -->
<!-- ### output_tensor_quantised: 1 -->
<!-- ### convert_type: hf -->
<!-- ### vocab_type: -->
<!-- ### tags: -->
static quants of https://huggingface.co/sazuyakun/medico-llama-3.2-1b-ver-2
<!-- provided-files -->
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#medico-llama-3.2-1b-ver-2-GGUF).***
weighted/imatrix quants seem not to be available (by me) at this time. If they do not show up a week or so after the static ones, I have probably not planned for them. Feel free to request them by opening a Community Discussion.
## Usage
If you are unsure how to use GGUF files, refer to one of [TheBloke's
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
more details, including on how to concatenate multi-part files.
## Provided Quants
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
| Link | Type | Size/GB | Notes |
|:-----|:-----|--------:|:------|
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q2_K.gguf) | Q2_K | 0.7 | |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q3_K_S.gguf) | Q3_K_S | 0.7 | |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q3_K_M.gguf) | Q3_K_M | 0.8 | lower quality |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q3_K_L.gguf) | Q3_K_L | 0.8 | |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.IQ4_XS.gguf) | IQ4_XS | 0.8 | |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q4_K_S.gguf) | Q4_K_S | 0.9 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q4_K_M.gguf) | Q4_K_M | 0.9 | fast, recommended |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q5_K_S.gguf) | Q5_K_S | 1.0 | |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q5_K_M.gguf) | Q5_K_M | 1.0 | |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q6_K.gguf) | Q6_K | 1.1 | very good quality |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.Q8_0.gguf) | Q8_0 | 1.4 | fast, best quality |
| [GGUF](https://huggingface.co/mradermacher/medico-llama-3.2-1b-ver-2-GGUF/resolve/main/medico-llama-3.2-1b-ver-2.f16.gguf) | f16 | 2.6 | 16 bpw, overkill |
Here is a handy graph by ikawrakow comparing some lower-quality quant
types (lower is better):
![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png)
And here are Artefact2's thoughts on the matter:
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
## FAQ / Model Request
See https://huggingface.co/mradermacher/model_requests for some answers to
questions you might have and/or if you want some other model quantized.
## Thanks
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
me use its servers and providing upgrades to my workstation to enable
this work in my free time.
<!-- end -->

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:290b40a8873c26655293a13273b14f2a23ce33c657408046c1444142b4fa052a
size 748385664

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:61315200186449248f5ef8180809b651ed05e572041c296d07c5f54892cb5cd1
size 580875648

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:43ad89d45e54b34574094d2c6afaf0f73a8258823c60c889586e6f4c5e1f9956
size 732525952

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e7ad00ee235c277d104f9c785303daea20f610399716db28760df0a7cca21b62
size 690845056

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:3aa06cbd6fcf8b413ddcfda5e1e195d5403f6dc11bed555768d84054640bc3b9
size 641693056

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:43ee20be7000a597cf1089960959dd093be5a7ba7cbc4631b7dc9854d0ca8fc3
size 807695744

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:74ced0f108ee43a82cc71fe42a8aa14bff05ed4b0683ee7722e2f7224c5e8269
size 775648640

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:beb8991815c300f0f620fe62da51fd86e28d55c4b30c655cb7b853df661af8ed
size 911504768

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:651adfa0bca227c0f5a16d7ad89d5b776468ad82f32e20a9f6262d982b052ff7
size 892564864

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:966aa5a39d2bea61b7224dfd1c8ae42a06fdc8dcfa9396643ea0097eb3259c8e
size 1021801856

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b89a021dedcc2adb68a0b519fcc88eaaf148cd5ccfb875d82db008db8874edcf
size 1321084288

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:cbc6e4b62698fc5eaaf85981fed1f6e7356280983191b2b8fa63ec89abc94b2e
size 2479596928