From 717a3f948f79a056b00af5caeb7c27cf5ca796e3 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 5 Jul 2026 04:16:12 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: second-state/Mistral-Nemo-Instruct-2407-GGUF Source: Original Platform --- .gitattributes | 48 ++++++++++++++ Mistral-Nemo-Instruct-2407-Q2_K.gguf | 3 + Mistral-Nemo-Instruct-2407-Q3_K_L.gguf | 3 + Mistral-Nemo-Instruct-2407-Q3_K_M.gguf | 3 + Mistral-Nemo-Instruct-2407-Q3_K_S.gguf | 3 + Mistral-Nemo-Instruct-2407-Q4_0.gguf | 3 + Mistral-Nemo-Instruct-2407-Q4_K_M.gguf | 3 + Mistral-Nemo-Instruct-2407-Q4_K_S.gguf | 3 + Mistral-Nemo-Instruct-2407-Q5_0.gguf | 3 + Mistral-Nemo-Instruct-2407-Q5_K_M.gguf | 3 + Mistral-Nemo-Instruct-2407-Q5_K_S.gguf | 3 + Mistral-Nemo-Instruct-2407-Q6_K.gguf | 3 + Mistral-Nemo-Instruct-2407-Q8_0.gguf | 3 + Mistral-Nemo-Instruct-2407-f16.gguf | 3 + README.md | 87 ++++++++++++++++++++++++++ config.json | 26 ++++++++ configuration.json | 1 + 17 files changed, 201 insertions(+) create mode 100644 .gitattributes create mode 100644 Mistral-Nemo-Instruct-2407-Q2_K.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q3_K_L.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q3_K_M.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q3_K_S.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q4_0.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q4_K_M.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q4_K_S.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q5_0.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q5_K_M.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q5_K_S.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q6_K.gguf create mode 100644 Mistral-Nemo-Instruct-2407-Q8_0.gguf create mode 100644 Mistral-Nemo-Instruct-2407-f16.gguf create mode 100644 README.md create mode 100644 config.json create mode 100644 configuration.json diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..38e5a64 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,48 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q4_0.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q5_0.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Mistral-Nemo-Instruct-2407-f16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/Mistral-Nemo-Instruct-2407-Q2_K.gguf b/Mistral-Nemo-Instruct-2407-Q2_K.gguf new file mode 100644 index 0000000..3d93c29 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bea290d014fa76c3cf7e0a3021094ede6d8cf8195becfd55e726bf2fed9a735b +size 4791047872 diff --git a/Mistral-Nemo-Instruct-2407-Q3_K_L.gguf b/Mistral-Nemo-Instruct-2407-Q3_K_L.gguf new file mode 100644 index 0000000..5ec5b60 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:27eb59d2642133da264bb15f9f998a361228790e6cb72abefa533c22841e1b65 +size 6561502912 diff --git a/Mistral-Nemo-Instruct-2407-Q3_K_M.gguf b/Mistral-Nemo-Instruct-2407-Q3_K_M.gguf new file mode 100644 index 0000000..e49f5ad --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:634e7fac8c9e6830295331ae54182c000a1cef492d26a0f57138f4a7bf28b2de +size 6083090112 diff --git a/Mistral-Nemo-Instruct-2407-Q3_K_S.gguf b/Mistral-Nemo-Instruct-2407-Q3_K_S.gguf new file mode 100644 index 0000000..f2d1541 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c3842eb732ce303a2ad5989c897825d9c2b0df50bbda29a80b4412043c76663b +size 5534226112 diff --git a/Mistral-Nemo-Instruct-2407-Q4_0.gguf b/Mistral-Nemo-Instruct-2407-Q4_0.gguf new file mode 100644 index 0000000..b4be84d --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q4_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7817bc6f4b3891d2aa6003bd8a826554cab4acec14d46c91e898e31251af7f3f +size 7071700672 diff --git a/Mistral-Nemo-Instruct-2407-Q4_K_M.gguf b/Mistral-Nemo-Instruct-2407-Q4_K_M.gguf new file mode 100644 index 0000000..76019c8 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:186ac886e5cf42a6ca0815e60504f13c7cc95446eb05ac2f1515e388976cebcf +size 7477204672 diff --git a/Mistral-Nemo-Instruct-2407-Q4_K_S.gguf b/Mistral-Nemo-Instruct-2407-Q4_K_S.gguf new file mode 100644 index 0000000..5bfd729 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:00eda01cc0a4868050e4bd64fdf4890d940d7c756a29901225c8ffd61d1b4ac8 +size 7120197312 diff --git a/Mistral-Nemo-Instruct-2407-Q5_0.gguf b/Mistral-Nemo-Instruct-2407-Q5_0.gguf new file mode 100644 index 0000000..dfa4e39 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q5_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f66aec032377d2c767a13f89c0149023f5283635de9a4389bd54e16ed3f99051 +size 8518735552 diff --git a/Mistral-Nemo-Instruct-2407-Q5_K_M.gguf b/Mistral-Nemo-Instruct-2407-Q5_K_M.gguf new file mode 100644 index 0000000..80d7b7f --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fdc6d65155e7908af3b9675a84f08400d0df8bc470281ec5d183f5d886a4824a +size 8727631552 diff --git a/Mistral-Nemo-Instruct-2407-Q5_K_S.gguf b/Mistral-Nemo-Instruct-2407-Q5_K_S.gguf new file mode 100644 index 0000000..2ebd149 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b3ce16c9a4ec48d02cdbe4bdef829e7f628ebae05bddad6ba1aab7c0cf37d782 +size 8518735552 diff --git a/Mistral-Nemo-Instruct-2407-Q6_K.gguf b/Mistral-Nemo-Instruct-2407-Q6_K.gguf new file mode 100644 index 0000000..1f135fb --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:48318ea51217b0c92a12314d738a5982b273c5d335c118a903c0b3a96756977a +size 10056210112 diff --git a/Mistral-Nemo-Instruct-2407-Q8_0.gguf b/Mistral-Nemo-Instruct-2407-Q8_0.gguf new file mode 100644 index 0000000..6127392 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:824229be17606dd8177fc91c1d330b065bc4f3de2873eab614376b988dcbf48a +size 13022369472 diff --git a/Mistral-Nemo-Instruct-2407-f16.gguf b/Mistral-Nemo-Instruct-2407-f16.gguf new file mode 100644 index 0000000..f785574 --- /dev/null +++ b/Mistral-Nemo-Instruct-2407-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7a9581ae7a87e5727aa1b0670f439ffe2a31a4bcb38ca201f9cd76ac975d31ae +size 24504276672 diff --git a/README.md b/README.md new file mode 100644 index 0000000..e5e50d9 --- /dev/null +++ b/README.md @@ -0,0 +1,87 @@ +--- +license: apache-2.0 +model_name: Mistral-Nemo-Instruct-2407 +base_model: mistralai/Mistral-Nemo-Instruct-2407 +inference: false +model_creator: mistralai +quantized_by: Second State Inc. +language: + - en + - fr + - de + - es + - it + - pt + - ru + - zh + - ja +--- + + + +
+ +
+
+ + +# Mistral-Nemo-Instruct-2407-GGUF + +## Original Model + +[mistralai/Mistral-Nemo-Instruct-2407](https://huggingface.co/mistralai/Mistral-Nemo-Instruct-2407) + +## Run with LlamaEdge + +- LlamaEdge version: [v0.12.4](https://github.com/LlamaEdge/LlamaEdge/releases/tag/0.12.4) + +- Prompt template + + - Prompt type: `mistral-instruct` + + - Prompt string + + ```text + [INST] {user_message_1} [/INST]{assistant_message_1}[INST] {user_message_2} [/INST]{assistant_message_2} + ``` + +- Context size: `128000` + +- Run as LlamaEdge service + + ```bash + wasmedge --dir .:. --nn-preload default:GGML:AUTO:Mistral-Nemo-Instruct-2407-Q5_K_M.gguf \ + llama-api-server.wasm \ + --prompt-template mistral-instruct \ + --ctx-size 128000 \ + --model-name Mistral-Nemo-Instruct-2407 + ``` + +- Run as LlamaEdge command app + + ```bash + wasmedge --dir .:. --nn-preload default:GGML:AUTO:Mistral-Nemo-Instruct-2407-Q5_K_M.gguf \ + llama-chat.wasm \ + --prompt-template mistral-instruct \ + --ctx-size 128000 + ``` + +## Quantized GGUF Models + +| Name | Quant method | Bits | Size | Use case | +| ---- | ---- | ---- | ---- | ----- | +| [Mistral-Nemo-Instruct-2407-Q2_K.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q2_K.gguf) | Q2_K | 2 | 4.79 GB| smallest, significant quality loss - not recommended for most purposes | +| [Mistral-Nemo-Instruct-2407-Q3_K_L.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q3_K_L.gguf) | Q3_K_L | 3 | 6.56 GB| small, substantial quality loss | +| [Mistral-Nemo-Instruct-2407-Q3_K_M.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q3_K_M.gguf) | Q3_K_M | 3 | 6.08 GB| very small, high quality loss | +| [Mistral-Nemo-Instruct-2407-Q3_K_S.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q3_K_S.gguf) | Q3_K_S | 3 | 5.53 GB| very small, high quality loss | +| [Mistral-Nemo-Instruct-2407-Q4_0.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q4_0.gguf) | Q4_0 | 4 | 7.07 GB| legacy; small, very high quality loss - prefer using Q3_K_M | +| [Mistral-Nemo-Instruct-2407-Q4_K_M.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q4_K_M.gguf) | Q4_K_M | 4 | 7.48 GB| medium, balanced quality - recommended | +| [Mistral-Nemo-Instruct-2407-Q4_K_S.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q4_K_S.gguf) | Q4_K_S | 4 | 7.12 GB| small, greater quality loss | +| [Mistral-Nemo-Instruct-2407-Q5_0.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q5_0.gguf) | Q5_0 | 5 | 8.52 GB| legacy; medium, balanced quality - prefer using Q4_K_M | +| [Mistral-Nemo-Instruct-2407-Q5_K_M.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/resolve/main/Mistral-Nemo-Instruct-2407-Q5_K_M.gguf) | Q5_K_M | 5 | 8.73 GB| large, very low quality loss - recommended | +| [Mistral-Nemo-Instruct-2407-Q5_K_S.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q5_K_S.gguf) | Q5_K_S | 5 | 8.52 GB| large, low quality loss - recommended | +| [Mistral-Nemo-Instruct-2407-Q6_K.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q6_K.gguf) | Q6_K | 6 | 10.1 GB| very large, extremely low quality loss | +| [Mistral-Nemo-Instruct-2407-Q8_0.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-Q8_0.gguf) | Q8_0 | 8 | 13.0 GB| very large, extremely low quality loss - not recommended | +| [Mistral-Nemo-Instruct-2407-f16.gguf](https://huggingface.co/second-state/Mistral-Nemo-Instruct-2407-GGUF/blob/main/Mistral-Nemo-Instruct-2407-f16.gguf) | f16 | 16 | 24.5 GB| | + +*Quantized with llama.cpp b3438.* \ No newline at end of file diff --git a/config.json b/config.json new file mode 100644 index 0000000..13c2786 --- /dev/null +++ b/config.json @@ -0,0 +1,26 @@ +{ + "architectures": [ + "MistralForCausalLM" + ], + "attention_dropout": 0.0, + "bos_token_id": 1, + "eos_token_id": 2, + "head_dim": 128, + "hidden_act": "silu", + "hidden_size": 5120, + "initializer_range": 0.02, + "intermediate_size": 14336, + "max_position_embeddings": 1024000, + "model_type": "mistral", + "num_attention_heads": 32, + "num_hidden_layers": 40, + "num_key_value_heads": 8, + "rms_norm_eps": 1e-05, + "rope_theta": 1000000.0, + "sliding_window": null, + "tie_word_embeddings": false, + "torch_dtype": "bfloat16", + "transformers_version": "4.43.0.dev0", + "use_cache": true, + "vocab_size": 131072 +} diff --git a/configuration.json b/configuration.json new file mode 100644 index 0000000..bbeeda1 --- /dev/null +++ b/configuration.json @@ -0,0 +1 @@ +{"framework": "pytorch", "task": "text-generation", "allow_remote": true} \ No newline at end of file