commit c8fd9f9586a9990e175c0eb5b49d82e126ac3fd2 Author: ModelHub XC Date: Sun May 31 03:55:19 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..a5b18f2 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.f16.gguf filter=lfs diff=lfs merge=lfs -text +Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.IQ4_XS.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.IQ4_XS.gguf new file mode 100644 index 0000000..ad880cc --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ff5de3c17f813bbd2110a162ec271119987dbbd4bd18689bae8ed5d1aa4503de +size 4484368480 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q2_K.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q2_K.gguf new file mode 100644 index 0000000..073c08b --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:651fc2b9af7b17f681b70add71ed71ba3bcb089b1b238964145ea87de9c58d9d +size 3179137120 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_L.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_L.gguf new file mode 100644 index 0000000..4d87290 --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4048a1a8ebe1efc78593d4ddd5e6032145362b153418c7ba5dc3d1ebe5b1776d +size 4321962080 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_M.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_M.gguf new file mode 100644 index 0000000..1104c8f --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2434adebed3667ceca4c3ae053a67caa9fd2e6e1b272be58d1fc0bd608291d9e +size 4018923616 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_S.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_S.gguf new file mode 100644 index 0000000..450eb52 --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1b9b8508ba22571b7c7c635917f588694434da0f9c1b0e9844b5d9eb86f8a8a1 +size 3664504928 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_M.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_M.gguf new file mode 100644 index 0000000..4aff6c2 --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5edfd40d2d5746f81fdb04871a53a20e2654ca4291daf09ccd2caee8a0f1479c +size 4920739936 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_S.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_S.gguf new file mode 100644 index 0000000..0155f9c --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c38e5386b895c6b2ba10a09143c296da1afbd685cc2766d1dd898bb17785c384 +size 4692674656 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_M.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_M.gguf new file mode 100644 index 0000000..46b68c7 --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c1ac1986fc3a68cb7f9457b92d40c11cdcda50c071b968e366b0bc168fba6885 +size 5732993120 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_S.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_S.gguf new file mode 100644 index 0000000..2045b5f --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:092147ef45a91e5d33164c850ff4980078919ff34b4d2ca7d3c644cf4980a734 +size 5599299680 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q6_K.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q6_K.gguf new file mode 100644 index 0000000..a669932 --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3b8b96a370d8cde53ec1f4e6eb4107160629da4fbb51d402f674f419c814fb98 +size 6596012128 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q8_0.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q8_0.gguf new file mode 100644 index 0000000..57c4c1b --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2cf7c519c6b1d898a3161a93423abb77fc1f9223cbd658e9c6bd283462aac766 +size 8540776544 diff --git a/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.f16.gguf b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.f16.gguf new file mode 100644 index 0000000..d5a6b8b --- /dev/null +++ b/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d317fdb06d146fc1288dd38a0cbda93e927687efa9409c571e607a4a06ecdca8 +size 16068896864 diff --git a/README.md b/README.md new file mode 100644 index 0000000..c3c3e61 --- /dev/null +++ b/README.md @@ -0,0 +1,76 @@ +--- +base_model: AmberYifan/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1 +language: +- en +library_name: transformers +model_name: Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1 +mradermacher: + readme_rev: 1 +quantized_by: mradermacher +tags: +- generated_from_trainer +- dpo +- trl +--- +## About + + + + + + + + + +static quants of https://huggingface.co/AmberYifan/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1 + + + +***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF).*** + +weighted/imatrix quants seem not to be available (by me) at this time. If they do not show up a week or so after the static ones, I have probably not planned for them. Feel free to request them by opening a Community Discussion. +## Usage + +If you are unsure how to use GGUF files, refer to one of [TheBloke's +READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for +more details, including on how to concatenate multi-part files. + +## Provided Quants + +(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants) + +| Link | Type | Size/GB | Notes | +|:-----|:-----|--------:|:------| +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q2_K.gguf) | Q2_K | 3.3 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_S.gguf) | Q3_K_S | 3.8 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_M.gguf) | Q3_K_M | 4.1 | lower quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q3_K_L.gguf) | Q3_K_L | 4.4 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.IQ4_XS.gguf) | IQ4_XS | 4.6 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_S.gguf) | Q4_K_S | 4.8 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q4_K_M.gguf) | Q4_K_M | 5.0 | fast, recommended | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_S.gguf) | Q5_K_S | 5.7 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q5_K_M.gguf) | Q5_K_M | 5.8 | | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q6_K.gguf) | Q6_K | 6.7 | very good quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.Q8_0.gguf) | Q8_0 | 8.6 | fast, best quality | +| [GGUF](https://huggingface.co/mradermacher/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1-GGUF/resolve/main/Llama-3.1-8B-Instruct-wildfeedback-RPO-DRIFT-iter1.f16.gguf) | f16 | 16.2 | 16 bpw, overkill | + +Here is a handy graph by ikawrakow comparing some lower-quality quant +types (lower is better): + +![image.png](https://www.nethype.de/huggingface_embed/quantpplgraph.png) + +And here are Artefact2's thoughts on the matter: +https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9 + +## FAQ / Model Request + +See https://huggingface.co/mradermacher/model_requests for some answers to +questions you might have and/or if you want some other model quantized. + +## Thanks + +I thank my company, [nethype GmbH](https://www.nethype.de/), for letting +me use its servers and providing upgrades to my workstation to enable +this work in my free time. + +