From ac05855ab6f5f2ab27b16e4c755596c5ff05fafa Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Mon, 14 Sep 2026 21:31:12 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: DevQuasar/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1-GGUF Source: Original Platform --- .gitattributes | 47 +++++++++++++++++++ README.md | 20 ++++++++ configuration.json | 1 + ....Llama-3.1-Nemotron-Nano-4B-v1.1.Q2_K.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_L.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_M.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_S.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_M.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_S.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_M.gguf | 3 ++ ...lama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_S.gguf | 3 ++ ....Llama-3.1-Nemotron-Nano-4B-v1.1.Q6_K.gguf | 3 ++ ....Llama-3.1-Nemotron-Nano-4B-v1.1.Q8_0.gguf | 3 ++ ...a.Llama-3.1-Nemotron-Nano-4B-v1.1.f16.gguf | 3 ++ 14 files changed, 101 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 configuration.json create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q2_K.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_L.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_M.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_S.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_M.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_S.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_M.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_S.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q6_K.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q8_0.gguf create mode 100644 nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.f16.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..53d7257 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.gguf* filter=lfs diff=lfs merge=lfs -text +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..9e79e4f --- /dev/null +++ b/README.md @@ -0,0 +1,20 @@ +--- +base_model: +- nvidia/Llama-3.1-Nemotron-Nano-4B-v1.1 +pipeline_tag: text-generation +--- + +[](https://devquasar.com) + +Quantized version of: [nvidia/Llama-3.1-Nemotron-Nano-4B-v1.1](https://huggingface.co/nvidia/Llama-3.1-Nemotron-Nano-4B-v1.1) + +'Make knowledge free for everyone' + +

+ Made with
+ + + +

+ +Buy Me a Coffee at ko-fi.com diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q2_K.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q2_K.gguf new file mode 100644 index 0000000..40c14d0 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:78d8096546adb1ea897b809bfd42482d27eef3fcc138c57c9d7e4482969d1d1f +size 1839740160 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_L.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_L.gguf new file mode 100644 index 0000000..e496fd1 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:83c9cbbdeded6a17a9ac9d85e74936286ff86e7270add91d725564f7b621eb60 +size 2464861440 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_M.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_M.gguf new file mode 100644 index 0000000..9d65430 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d1357d1f1611736f690f8a6cedee1b412dd45db2546e7689442c0832f9b863f6 +size 2296564992 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_S.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_S.gguf new file mode 100644 index 0000000..4da2664 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8c7cef48b4d6aaa1c948271b9404c310ca4ccc1b7322e34e0b1ea8b11b9d9966 +size 2101529856 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_M.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_M.gguf new file mode 100644 index 0000000..6e9a4ce --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b299a208f449b0eb8633784ff4fb5b86ef839b5958336b59e10e8edfd3e3e100 +size 2778285312 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_S.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_S.gguf new file mode 100644 index 0000000..93c1544 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3b442e1c1bae41d38e62f5cc6e00b2aa5a7baa4de61700c14f15edc7672e3921 +size 2664252672 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_M.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_M.gguf new file mode 100644 index 0000000..f6df1dc --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7ee2f9dc4cbe8465910efab26029c64633d043a547f95ad6dd3c5c4d207f366e +size 3230188800 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_S.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_S.gguf new file mode 100644 index 0000000..e4a6a8b --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a34963dca424f6eb2524691e90a7c22f39d7da80b8d63828a98194e06653fdb6 +size 3163342080 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q6_K.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q6_K.gguf new file mode 100644 index 0000000..1daf5d0 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cd3ea27942732b7cd3311e668e601f0fcfc66ddf2416f40bd854d254f647a2ed +size 3710336256 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q8_0.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q8_0.gguf new file mode 100644 index 0000000..aaf21e0 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f8c2f09e7163e253376c4780523ce94706b3d6c097199b0a1c1af54ee72c31e2 +size 4803218688 diff --git a/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.f16.gguf b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.f16.gguf new file mode 100644 index 0000000..4a07204 --- /dev/null +++ b/nvidia.Llama-3.1-Nemotron-Nano-4B-v1.1.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f36114e04c869821d82258fa45ce33c8fb72c1da2494eae4736856179446d416 +size 9033731328