初始化项目,由ModelHub XC社区提供模型
Model: mradermacher/gpt-oss-20b-offload-i1-GGUF Source: Original Platform
This commit is contained in:
59
.gitattributes
vendored
Normal file
59
.gitattributes
vendored
Normal file
@@ -0,0 +1,59 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.imatrix.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ3_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ3_XXS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ2_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q2_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ1_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ2_XXS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ2_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ2_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ1_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ3_XS.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-Q4_1.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
gpt-oss-20b-offload.i1-IQ3_S.gguf filter=lfs diff=lfs merge=lfs -text
|
||||
95
README.md
Normal file
95
README.md
Normal file
@@ -0,0 +1,95 @@
|
||||
---
|
||||
base_model: myselfsaurabh/gpt-oss-20b-offload
|
||||
datasets:
|
||||
- openai/gpt-oss-training-data
|
||||
language:
|
||||
- en
|
||||
library_name: transformers
|
||||
license: mit
|
||||
mradermacher:
|
||||
readme_rev: 1
|
||||
quantized_by: mradermacher
|
||||
tags:
|
||||
- gpt-oss
|
||||
- openai
|
||||
- mxfp4
|
||||
- mixture-of-experts
|
||||
- causal-lm
|
||||
- text-generation
|
||||
- cpu-gpu-offload
|
||||
- colab
|
||||
---
|
||||
## About
|
||||
|
||||
<!-- ### quantize_version: 2 -->
|
||||
<!-- ### output_tensor_quantised: 1 -->
|
||||
<!-- ### convert_type: hf -->
|
||||
<!-- ### vocab_type: -->
|
||||
<!-- ### tags: nicoboss -->
|
||||
<!-- ### quants: Q2_K IQ3_M Q4_K_S IQ3_XXS Q3_K_M small-IQ4_NL Q4_K_M IQ2_M Q6_K IQ4_XS Q2_K_S IQ1_M Q3_K_S IQ2_XXS Q3_K_L IQ2_XS Q5_K_S IQ2_S IQ1_S Q5_K_M Q4_0 IQ3_XS Q4_1 IQ3_S -->
|
||||
<!-- ### quants_skip: -->
|
||||
<!-- ### skip_mmproj: -->
|
||||
weighted/imatrix quants of https://huggingface.co/myselfsaurabh/gpt-oss-20b-offload
|
||||
|
||||
<!-- provided-files -->
|
||||
|
||||
***For a convenient overview and download list, visit our [model page for this model](https://hf.tst.eu/model#gpt-oss-20b-offload-i1-GGUF).***
|
||||
|
||||
static quants are available at https://huggingface.co/mradermacher/gpt-oss-20b-offload-GGUF
|
||||
## Usage
|
||||
|
||||
If you are unsure how to use GGUF files, refer to one of [TheBloke's
|
||||
READMEs](https://huggingface.co/TheBloke/KafkaLM-70B-German-V0.1-GGUF) for
|
||||
more details, including on how to concatenate multi-part files.
|
||||
|
||||
## Provided Quants
|
||||
|
||||
(sorted by size, not necessarily quality. IQ-quants are often preferable over similar sized non-IQ quants)
|
||||
|
||||
| Link | Type | Size/GB | Notes |
|
||||
|:-----|:-----|--------:|:------|
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.imatrix.gguf) | imatrix | 0.1 | imatrix file (for creating your own quants) |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ1_M.gguf) | i1-IQ1_M | 12.1 | mostly desperate |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ1_S.gguf) | i1-IQ1_S | 12.1 | for the desperate |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ2_XXS.gguf) | i1-IQ2_XXS | 12.1 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ2_XS.gguf) | i1-IQ2_XS | 12.1 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q3_K_S.gguf) | i1-Q3_K_S | 12.2 | IQ3_XS probably better |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ2_M.gguf) | i1-IQ2_M | 12.2 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ2_S.gguf) | i1-IQ2_S | 12.2 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ3_S.gguf) | i1-IQ3_S | 12.2 | beats Q3_K* |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ3_XS.gguf) | i1-IQ3_XS | 12.2 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ3_XXS.gguf) | i1-IQ3_XXS | 12.2 | lower quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q2_K.gguf) | i1-Q2_K | 12.2 | IQ3_XXS probably better |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ4_XS.gguf) | i1-IQ4_XS | 12.2 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q2_K_S.gguf) | i1-Q2_K_S | 12.2 | very low quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q4_0.gguf) | i1-Q4_0 | 12.2 | fast, low quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-IQ3_M.gguf) | i1-IQ3_M | 12.3 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q3_K_M.gguf) | i1-Q3_K_M | 13.0 | IQ3_S probably better |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q3_K_L.gguf) | i1-Q3_K_L | 13.4 | IQ3_M probably better |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q4_1.gguf) | i1-Q4_1 | 13.5 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q4_K_S.gguf) | i1-Q4_K_S | 14.8 | optimal size/speed/quality |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q4_K_M.gguf) | i1-Q4_K_M | 15.9 | fast, recommended |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q5_K_S.gguf) | i1-Q5_K_S | 16.0 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q5_K_M.gguf) | i1-Q5_K_M | 17.0 | |
|
||||
| [GGUF](https://huggingface.co/mradermacher/gpt-oss-20b-offload-i1-GGUF/resolve/main/gpt-oss-20b-offload.i1-Q6_K.gguf) | i1-Q6_K | 22.3 | practically like static Q6_K |
|
||||
|
||||
Here is a handy graph by ikawrakow comparing some lower-quality quant
|
||||
types (lower is better):
|
||||
|
||||

|
||||
|
||||
And here are Artefact2's thoughts on the matter:
|
||||
https://gist.github.com/Artefact2/b5f810600771265fc1e39442288e8ec9
|
||||
|
||||
## FAQ / Model Request
|
||||
|
||||
See https://huggingface.co/mradermacher/model_requests for some answers to
|
||||
questions you might have and/or if you want some other model quantized.
|
||||
|
||||
## Thanks
|
||||
|
||||
I thank my company, [nethype GmbH](https://www.nethype.de/), for letting
|
||||
me use its servers and providing upgrades to my workstation to enable
|
||||
this work in my free time. Additional thanks to [@nicoboss](https://huggingface.co/nicoboss) for giving me access to his private supercomputer, enabling me to provide many more imatrix quants, at much higher quality, than I would otherwise be able to.
|
||||
|
||||
<!-- end -->
|
||||
3
gpt-oss-20b-offload.i1-IQ1_M.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ1_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4335be98908d3b62584e4b57dc2a0c84b6e2d30e69d1afffef38edf266d526c5
|
||||
size 12016853984
|
||||
3
gpt-oss-20b-offload.i1-IQ1_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ1_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:9a74095d8905c57a4e80d2ffa9da056452d634791f8d5f6fff36850848e9f57a
|
||||
size 12016853984
|
||||
3
gpt-oss-20b-offload.i1-IQ2_M.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ2_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8c3918c61d3e65e10de322c0b5d9d84ae2a60a7f1d4e26c43ec48d5754f5823f
|
||||
size 12065514464
|
||||
3
gpt-oss-20b-offload.i1-IQ2_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ2_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ec7b583be082df9b4c5d5170886612ed26794adef14db901ae20e4c85cc506e9
|
||||
size 12065514464
|
||||
3
gpt-oss-20b-offload.i1-IQ2_XS.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ2_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:e677ee58b23ed7859bb1b2f94b496d174aba223a4eca6c442aa585d99730681a
|
||||
size 12025701344
|
||||
3
gpt-oss-20b-offload.i1-IQ2_XXS.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ2_XXS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:09efb6fa30107d914cfb3fcac59c8ccff17771b80e1c14279a1ecbe3c8b8f37d
|
||||
size 12016853984
|
||||
3
gpt-oss-20b-offload.i1-IQ3_M.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ3_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:ddeca9771aa0776c10f4d655f234afe8f276a9f3f226535d94d8d10a09a15da8
|
||||
size 12202648544
|
||||
3
gpt-oss-20b-offload.i1-IQ3_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ3_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4eb25d0ab04c04c9ee3d90152aef781d91edd8ad49a67a781c80ec89fe553b01
|
||||
size 12065514464
|
||||
3
gpt-oss-20b-offload.i1-IQ3_XS.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ3_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:62110eec792d728f37e9020ab5178781d761fee78e07757bb12079d2aea37991
|
||||
size 12065514464
|
||||
3
gpt-oss-20b-offload.i1-IQ3_XXS.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ3_XXS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:664f22e8cec89538335ae8f4a2c475ac0b04bdde90979da0e50ff6ac1f738e93
|
||||
size 12065514464
|
||||
3
gpt-oss-20b-offload.i1-IQ4_XS.gguf
Normal file
3
gpt-oss-20b-offload.i1-IQ4_XS.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:4b0193c473bf675e523fa90da865f54ba7c0aa675958326263433304de8b70d0
|
||||
size 12096480224
|
||||
3
gpt-oss-20b-offload.i1-Q2_K.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q2_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:bb69c4f5ab504716621be3488b3ee6719d954daf2738eccc12b20763194c2374
|
||||
size 12065514464
|
||||
3
gpt-oss-20b-offload.i1-Q2_K_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q2_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f3b32606c92b18488d58a72356ff5a6a8420ed236088f4ad6e025e9e304afbd6
|
||||
size 12136293344
|
||||
3
gpt-oss-20b-offload.i1-Q3_K_L.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q3_K_L.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:7734b98398f0a8e8e815bbf9ddf9c0b1f4a384c0e9b34f4bd9f7a589c6b966cc
|
||||
size 13335110624
|
||||
3
gpt-oss-20b-offload.i1-Q3_K_M.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q3_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:98d212d7011813e15435323c7b2abf0aeb027313a6464eebd0a1cb0e79aa12f8
|
||||
size 12916151264
|
||||
3
gpt-oss-20b-offload.i1-Q3_K_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q3_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:6bf0e7b06f6cb83f38195333dc2a2796307c3840e35209d205d8d761e2d57981
|
||||
size 12061090784
|
||||
3
gpt-oss-20b-offload.i1-Q4_0.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q4_0.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:3ba6bcce5728f326107534c83610c7de23ee588fb4fb4c0175707aeb02174760
|
||||
size 12148458464
|
||||
3
gpt-oss-20b-offload.i1-Q4_1.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q4_1.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:48fd6283a4e8db50713457a51894d4b1a1145c732b572de2f90cd0f9ef4618ad
|
||||
size 13369094624
|
||||
3
gpt-oss-20b-offload.i1-Q4_K_M.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q4_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:e5deba816ea68d92dea2b10c6568957f1ba67c96d4c541c89ec6a6f551166399
|
||||
size 15805136864
|
||||
3
gpt-oss-20b-offload.i1-Q4_K_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q4_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b56696a4d6121e9dfaeb345e225d683e2011753ad7ce849e7a5fdea0af1c641e
|
||||
size 14654242784
|
||||
3
gpt-oss-20b-offload.i1-Q5_K_M.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q5_K_M.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:2a461025ed8b7185cdaa683269da0d953702d9ed0c7249314ebe8ff4b128c353
|
||||
size 16893062624
|
||||
3
gpt-oss-20b-offload.i1-Q5_K_S.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q5_K_S.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:0069c744f1064785d9dc11e20c6f21b0aaf01a10d1c490e322b9f1764bb60de5
|
||||
size 15892205024
|
||||
3
gpt-oss-20b-offload.i1-Q6_K.gguf
Normal file
3
gpt-oss-20b-offload.i1-Q6_K.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:b4e3eee2765edd9d5e8694a0f165dcfe2dfcdadfa838578208b0ef9cf1b9a72c
|
||||
size 22193345504
|
||||
3
gpt-oss-20b-offload.imatrix.gguf
Normal file
3
gpt-oss-20b-offload.imatrix.gguf
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:fdd893cbf09c1aee7ffb4642d6d51b3583ee2b90eaaa03eda31d114a8ab58d25
|
||||
size 28079776
|
||||
Reference in New Issue
Block a user