commit 9f35949e64baabda47fbd26e781f92bdc69a77db Author: ModelHub XC Date: Tue Sep 22 14:45:13 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: DevQuasar/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..53d7257 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,47 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bin.* filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zstandard filter=lfs diff=lfs merge=lfs -text +*.tfevents* filter=lfs diff=lfs merge=lfs -text +*.db* filter=lfs diff=lfs merge=lfs -text +*.ark* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*data* filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text +**/*ckpt*.index filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.gguf* filter=lfs diff=lfs merge=lfs -text +*.ggml filter=lfs diff=lfs merge=lfs -text +*.llamafile* filter=lfs diff=lfs merge=lfs -text +*.pt2 filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text \ No newline at end of file diff --git a/README.md b/README.md new file mode 100644 index 0000000..026f72f --- /dev/null +++ b/README.md @@ -0,0 +1,20 @@ +--- +base_model: +- nvidia/Llama-3.1-8B-UltraLong-1M-Instruct +pipeline_tag: text-generation +--- + +[](https://devquasar.com) + +Quantized version of: [nvidia/Llama-3.1-8B-UltraLong-1M-Instruct](https://huggingface.co/nvidia/Llama-3.1-8B-UltraLong-1M-Instruct) + +'Make knowledge free for everyone' + +

+ Made with
+ + + +

+ +Buy Me a Coffee at ko-fi.com diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q2_K.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q2_K.gguf new file mode 100644 index 0000000..b6d6d53 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4277bfa77179465d33395a70c9cb60ad9fa9884c90c71ed3b01bb2389a39c168 +size 3182766368 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_L.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_L.gguf new file mode 100644 index 0000000..db47a73 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:140f0d52f9162c8374ac3430088d2e2ad8ac1e236dcbeaa8488ddc1b4c7440f5 +size 4325910816 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_M.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_M.gguf new file mode 100644 index 0000000..4c0a9b0 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:660b5557de4bb3d55668bcb914cea7f69a65edc0ba1261cdbdfe111dcd087ea1 +size 4022872352 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_S.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_S.gguf new file mode 100644 index 0000000..e1bc0f6 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fb8218e531225e1a142e5f583aae19b5da8013cab696a34fd2479f474162bc4c +size 3668453664 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q4_K_M.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q4_K_M.gguf new file mode 100644 index 0000000..e3950df --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3bab3ff7df9315282d757dd0600c85b773f1d0d858de60fc3a771a0fd1a86173 +size 4925106464 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q4_K_S.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q4_K_S.gguf new file mode 100644 index 0000000..6cb867f --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6e3dc85915e063a1f816f462db9dcf41abd4428b3e64bf1db27ef8aa49b3801b +size 4697041184 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q5_K_M.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q5_K_M.gguf new file mode 100644 index 0000000..ccbe855 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:15db5fb173ccb77bb50698a23c5d6decb3b8bf5286691206a5c5e2746790c95f +size 5737752864 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q5_K_S.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q5_K_S.gguf new file mode 100644 index 0000000..774ec3a --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0111d012dc7a87af01f254442068f904b73fb794b97c38f37afe533da948fe8f +size 5604059424 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q6_K.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q6_K.gguf new file mode 100644 index 0000000..7423be8 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:23f250200daca30a39e1dff1c3daf977c5dcf320dca0fdbca6f71a80bb15f217 +size 6601189664 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q8_0.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q8_0.gguf new file mode 100644 index 0000000..8a58d48 --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7fd869269c029161d15eced7b6e0f7550c9c9bfc15fdfed3aec3919be2f111b0 +size 8547477792 diff --git a/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.f16.gguf b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.f16.gguf new file mode 100644 index 0000000..03c0a9e --- /dev/null +++ b/nvidia.Llama-3.1-8B-UltraLong-1M-Instruct.f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0d9b0db65d19642c2c77b0dcb1359a1c685b4d1dfc96488542d9eb9a51323e1c +size 16081496352