初始化项目，由ModelHub XC社区提供模型

Model: mistralai/Mistral-7B-Instruct-v0.2 Source: Original Platform
2026-05-21 18:52:12 +08:00
commit 4e79944cdb
17 changed files with 91725 additions and 0 deletions
--- a/.gitattributes
+++ b/.gitattributes
@@ -0,0 +1,47 @@
 *.7z filter=lfs diff=lfs merge=lfs -text
 *.arrow filter=lfs diff=lfs merge=lfs -text
 *.bin filter=lfs diff=lfs merge=lfs -text
 *.bin.* filter=lfs diff=lfs merge=lfs -text
 *.bz2 filter=lfs diff=lfs merge=lfs -text
 *.ftz filter=lfs diff=lfs merge=lfs -text
 *.gz filter=lfs diff=lfs merge=lfs -text
 *.h5 filter=lfs diff=lfs merge=lfs -text
 *.joblib filter=lfs diff=lfs merge=lfs -text
 *.lfs.* filter=lfs diff=lfs merge=lfs -text
 *.model filter=lfs diff=lfs merge=lfs -text
 *.msgpack filter=lfs diff=lfs merge=lfs -text
 *.onnx filter=lfs diff=lfs merge=lfs -text
 *.ot filter=lfs diff=lfs merge=lfs -text
 *.parquet filter=lfs diff=lfs merge=lfs -text
 *.pb filter=lfs diff=lfs merge=lfs -text
 *.pt filter=lfs diff=lfs merge=lfs -text
 *.pth filter=lfs diff=lfs merge=lfs -text
 *.rar filter=lfs diff=lfs merge=lfs -text
 saved_model/**/* filter=lfs diff=lfs merge=lfs -text
 *.tar.* filter=lfs diff=lfs merge=lfs -text
 *.tflite filter=lfs diff=lfs merge=lfs -text
 *.tgz filter=lfs diff=lfs merge=lfs -text
 *.xz filter=lfs diff=lfs merge=lfs -text
 *.zip filter=lfs diff=lfs merge=lfs -text
 *.zstandard filter=lfs diff=lfs merge=lfs -text
 *.tfevents* filter=lfs diff=lfs merge=lfs -text
 *.db* filter=lfs diff=lfs merge=lfs -text
 *.ark* filter=lfs diff=lfs merge=lfs -text
 **/*ckpt*data* filter=lfs diff=lfs merge=lfs -text
 **/*ckpt*.meta filter=lfs diff=lfs merge=lfs -text
 **/*ckpt*.index filter=lfs diff=lfs merge=lfs -text
 *.safetensors filter=lfs diff=lfs merge=lfs -text
 *.ckpt filter=lfs diff=lfs merge=lfs -text
 *.gguf* filter=lfs diff=lfs merge=lfs -text
 *.ggml filter=lfs diff=lfs merge=lfs -text
 *.llamafile* filter=lfs diff=lfs merge=lfs -text
 *.pt2 filter=lfs diff=lfs merge=lfs -text
 *.mlmodel filter=lfs diff=lfs merge=lfs -text
 *.npy filter=lfs diff=lfs merge=lfs -text
 *.npz filter=lfs diff=lfs merge=lfs -text
 *.pickle filter=lfs diff=lfs merge=lfs -text
 *.pkl filter=lfs diff=lfs merge=lfs -text
 *.tar filter=lfs diff=lfs merge=lfs -text
 *.wasm filter=lfs diff=lfs merge=lfs -text
 *.zst filter=lfs diff=lfs merge=lfs -text
 *tfevents* filter=lfs diff=lfs merge=lfs -text
--- a/README.md
+++ b/README.md
@@ -0,0 +1,144 @@
 ---
 library_name: transformers
 license: apache-2.0
 tags:
 - finetuned
 - mistral-common
 new_version: mistralai/Mistral-7B-Instruct-v0.3
 inference: false
 widget:
 - messages:
  - role: user
    content: What is your favorite condiment?
 extra_gated_description: >-
  If you want to learn more about how we process your personal data, please read
  our <a href="https://mistral.ai/terms/">Privacy Policy</a>.
 ---
 # Model Card for Mistral-7B-Instruct-v0.2
 ## Encode and Decode with `mistral_common`
 ```py
 from mistral_common.tokens.tokenizers.mistral import MistralTokenizer
 from mistral_common.protocol.instruct.messages import UserMessage
 from mistral_common.protocol.instruct.request import ChatCompletionRequest
 mistral_models_path = "MISTRAL_MODELS_PATH"
 tokenizer = MistralTokenizer.v1()
 completion_request = ChatCompletionRequest(messages=[UserMessage(content="Explain Machine Learning to me in a nutshell.")])
 tokens = tokenizer.encode_chat_completion(completion_request).tokens
 ```
 ## Inference with `mistral_inference`
 ```py
 from mistral_inference.transformer import Transformer
 from mistral_inference.generate import generate
 model = Transformer.from_folder(mistral_models_path)
 out_tokens, _ = generate([tokens], model, max_tokens=64, temperature=0.0, eos_id=tokenizer.instruct_tokenizer.tokenizer.eos_id)
 result = tokenizer.decode(out_tokens[0])
 print(result)
 ```
 ## Inference with hugging face `transformers`
 ```py
 from transformers import AutoModelForCausalLM
 model = AutoModelForCausalLM.from_pretrained("mistralai/Mistral-7B-Instruct-v0.2")
 model.to("cuda")
 generated_ids = model.generate(tokens, max_new_tokens=1000, do_sample=True)
 # decode with mistral tokenizer
 result = tokenizer.decode(generated_ids[0].tolist())
 print(result)
 ```
 > [!TIP]
 > PRs to correct the `transformers` tokenizer so that it gives 1-to-1 the same results as the `mistral_common` reference implementation are very welcome!
 ---
 The Mistral-7B-Instruct-v0.2 Large Language Model (LLM) is an instruct fine-tuned version of the Mistral-7B-v0.2.
 Mistral-7B-v0.2 has the following changes compared to Mistral-7B-v0.1
 - 32k context window (vs 8k context in v0.1)
 - Rope-theta = 1e6
 - No Sliding-Window Attention
 For full details of this model please read our [paper](https://arxiv.org/abs/2310.06825) and [release blog post](https://mistral.ai/news/la-plateforme/).
 ## Instruction format
 In order to leverage instruction fine-tuning, your prompt should be surrounded by `[INST]` and `[/INST]` tokens. The very first instruction should begin with a begin of sentence id. The next instructions should not. The assistant generation will be ended by the end-of-sentence token id.
 E.g.
 ```
 text = "<s>[INST] What is your favourite condiment? [/INST]"
 "Well, I'm quite partial to a good squeeze of fresh lemon juice. It adds just the right amount of zesty flavour to whatever I'm cooking up in the kitchen!</s> "
 "[INST] Do you have mayonnaise recipes? [/INST]"
 ```
 This format is available as a [chat template](https://huggingface.co/docs/transformers/main/chat_templating) via the `apply_chat_template()` method:
 ```python
 from transformers import AutoModelForCausalLM, AutoTokenizer
 device = "cuda" # the device to load the model onto
 model = AutoModelForCausalLM.from_pretrained("mistralai/Mistral-7B-Instruct-v0.2")
 tokenizer = AutoTokenizer.from_pretrained("mistralai/Mistral-7B-Instruct-v0.2")
 messages = [
    {"role": "user", "content": "What is your favourite condiment?"},
    {"role": "assistant", "content": "Well, I'm quite partial to a good squeeze of fresh lemon juice. It adds just the right amount of zesty flavour to whatever I'm cooking up in the kitchen!"},
    {"role": "user", "content": "Do you have mayonnaise recipes?"}
 ]
 encodeds = tokenizer.apply_chat_template(messages, return_tensors="pt")
 model_inputs = encodeds.to(device)
 model.to(device)
 generated_ids = model.generate(model_inputs, max_new_tokens=1000, do_sample=True)
 decoded = tokenizer.batch_decode(generated_ids)
 print(decoded[0])
 ```
 ## Troubleshooting
 - If you see the following error:
 ```
 Traceback (most recent call last):
 File "", line 1, in
 File "/transformers/models/auto/auto_factory.py", line 482, in from_pretrained
 config, kwargs = AutoConfig.from_pretrained(
 File "/transformers/models/auto/configuration_auto.py", line 1022, in from_pretrained
 config_class = CONFIG_MAPPING[config_dict["model_type"]]
 File "/transformers/models/auto/configuration_auto.py", line 723, in getitem
 raise KeyError(key)
 KeyError: 'mistral'
 ```
 Installing transformers from source should solve the issue
 pip install git+https://github.com/huggingface/transformers
 This should not be required after transformers-v4.33.4.
 ## Limitations
 The Mistral 7B Instruct model is a quick demonstration that the base model can be easily fine-tuned to achieve compelling performance. 
 It does not have any moderation mechanisms. We're looking forward to engaging with the community on ways to
 make the model finely respect guardrails, allowing for deployment in environments requiring moderated outputs.
 ## The Mistral AI Team
 Albert Jiang, Alexandre Sablayrolles, Arthur Mensch, Blanche Savary, Chris Bamford, Devendra Singh Chaplot, Diego de las Casas, Emma Bou Hanna, Florian Bressand, Gianna Lengyel, Guillaume Bour, Guillaume Lample, Lélio Renard Lavaud, Louis Ternon, Lucile Saulnier, Marie-Anne Lachaux, Pierre Stock, Teven Le Scao, Théophile Gervet, Thibaut Lavril, Thomas Wang, Timothée Lacroix, William El Sayed.
--- a/config.json
+++ b/config.json
@@ -0,0 +1,25 @@
 {
  "architectures": [
    "MistralForCausalLM"
  ],
  "attention_dropout": 0.0,
  "bos_token_id": 1,
  "eos_token_id": 2,
  "hidden_act": "silu",
  "hidden_size": 4096,
  "initializer_range": 0.02,
  "intermediate_size": 14336,
  "max_position_embeddings": 32768,
  "model_type": "mistral",
  "num_attention_heads": 32,
  "num_hidden_layers": 32,
  "num_key_value_heads": 8,
  "rms_norm_eps": 1e-05,
  "rope_theta": 1000000.0,
  "sliding_window": null,
  "tie_word_embeddings": false,
  "torch_dtype": "bfloat16",
  "transformers_version": "4.36.0",
  "use_cache": true,
  "vocab_size": 32000
 }
--- a/configuration.json
+++ b/configuration.json
@@ -0,0 +1 @@
 {"framework": "pytorch", "task": "text-generation", "allow_remote": true}
--- a/generation_config.json
+++ b/generation_config.json
@@ -0,0 +1,6 @@
 {
  "_from_model_config": true,
  "bos_token_id": 1,
  "eos_token_id": 2,
  "transformers_version": "4.36.0"
 }
--- a/model-00001-of-00003.safetensors
+++ b/model-00001-of-00003.safetensors
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:63654d601820b88b1fa8b4a98df5714f700fbc5b3df2cc4ecbabdced35096d31
 size 4943162336
--- a/model-00002-of-00003.safetensors
+++ b/model-00002-of-00003.safetensors
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:a42716540ecb2385d371f2109835921ff535406cac8fe8ff28f2f0b5fc7895bd
 size 4999819336
--- a/model-00003-of-00003.safetensors
+++ b/model-00003-of-00003.safetensors
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:5f86e15cb3ed9078e30ae6e72445e109d0e337d9cde59b9aeea4ce8e44e54a5d
 size 4540516344
--- a/model.safetensors.index.json
+++ b/model.safetensors.index.json
@@ -0,0 +1,298 @@
 {
    "metadata": {
        "total_size": 14483464192
    },
    "weight_map": {
        "lm_head.weight": "model-00003-of-00003.safetensors",
        "model.embed_tokens.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.0.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.1.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.10.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.10.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.10.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.10.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.10.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.10.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.10.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.10.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.10.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.11.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.11.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.12.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.13.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.14.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.15.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.16.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.17.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.18.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.19.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.2.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.2.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.20.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.20.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.input_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.mlp.down_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.mlp.gate_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.mlp.up_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.post_attention_layernorm.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.21.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.22.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.22.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.22.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.22.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.22.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.22.self_attn.k_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.22.self_attn.o_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.22.self_attn.q_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.22.self_attn.v_proj.weight": "model-00002-of-00003.safetensors",
        "model.layers.23.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.23.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.24.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.25.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.26.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.27.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.28.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.29.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.3.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.3.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.30.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.30.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.input_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.mlp.down_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.mlp.gate_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.mlp.up_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.post_attention_layernorm.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.self_attn.k_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.self_attn.o_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.self_attn.q_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.31.self_attn.v_proj.weight": "model-00003-of-00003.safetensors",
        "model.layers.4.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.4.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.5.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.6.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.7.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.8.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.input_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.mlp.down_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.mlp.gate_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.mlp.up_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.post_attention_layernorm.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.self_attn.k_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.self_attn.o_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.self_attn.q_proj.weight": "model-00001-of-00003.safetensors",
        "model.layers.9.self_attn.v_proj.weight": "model-00001-of-00003.safetensors",
        "model.norm.weight": "model-00003-of-00003.safetensors"
    }
 }
--- a/pytorch_model-00001-of-00003.bin
+++ b/pytorch_model-00001-of-00003.bin
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:d8836f675fe1c4c43f3ff4e93f4cc0e97ef7a13e8c240fb39ad02d37ff303ef5
 size 4943184288
--- a/pytorch_model-00002-of-00003.bin
+++ b/pytorch_model-00002-of-00003.bin
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:58a7ddffb463397de5dbe1f1e2ec1ccf6aae2b549565f83f3ded124e0b4c5069
 size 4999843272
--- a/pytorch_model-00003-of-00003.bin
+++ b/pytorch_model-00003-of-00003.bin
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:75824d68dcf82d02b731b2bdfd3a9711acb7c58b8d566f4c0d3e9efac52f9a21
 size 5064824210
--- a/pytorch_model.bin.index.json
+++ b/pytorch_model.bin.index.json
@@ -0,0 +1,3 @@
 version https://git-lfs.github.com/spec/v1
 oid sha256:5fc5f5d86e6a6cea0356e34224ce999c5c3c955a1717ef450579fd161ac8d103
 size 23950
--- a/special_tokens_map.json
+++ b/special_tokens_map.json
@@ -0,0 +1,23 @@
 {
  "bos_token": {
    "content": "<s>",
    "lstrip": false,
    "normalized": false,
    "rstrip": false,
    "single_word": false
  },
  "eos_token": {
    "content": "</s>",
    "lstrip": false,
    "normalized": false,
    "rstrip": false,
    "single_word": false
  },
  "unk_token": {
    "content": "<unk>",
    "lstrip": false,
    "normalized": false,
    "rstrip": false,
    "single_word": false
  }
 }
--- a/tokenizer.json
+++ b/tokenizer.json
--- a/tokenizer.model
+++ b/tokenizer.model
--- a/tokenizer_config.json
+++ b/tokenizer_config.json
@@ -0,0 +1,44 @@
 {
  "add_bos_token": true,
  "add_eos_token": false,
  "add_prefix_space": null,
  "added_tokens_decoder": {
    "0": {
      "content": "<unk>",
      "lstrip": false,
      "normalized": false,
      "rstrip": false,
      "single_word": false,
      "special": true
    },
    "1": {
      "content": "<s>",
      "lstrip": false,
      "normalized": false,
      "rstrip": false,
      "single_word": false,
      "special": true
    },
    "2": {
      "content": "</s>",
      "lstrip": false,
      "normalized": false,
      "rstrip": false,
      "single_word": false,
      "special": true
    }
  },
  "additional_special_tokens": [],
  "bos_token": "<s>",
  "chat_template": "{%- if messages[0]['role'] == 'system' %}\n    {%- set system_message = messages[0]['content'] %}\n    {%- set loop_messages = messages[1:] %}\n{%- else %}\n    {%- set loop_messages = messages %}\n{%- endif %}\n\n{{- bos_token }}\n{%- for message in loop_messages %}\n    {%- if (message['role'] == 'user') != (loop.index0 % 2 == 0) %}\n        {{- raise_exception('After the optional system message, conversation roles must alternate user/assistant/user/assistant/...') }}\n    {%- endif %}\n    {%- if message['role'] == 'user' %}\n        {%- if loop.first and system_message is defined %}\n            {{- ' [INST] ' + system_message + '\\n\\n' + message['content'] + ' [/INST]' }}\n        {%- else %}\n            {{- ' [INST] ' + message['content'] + ' [/INST]' }}\n        {%- endif %}\n    {%- elif message['role'] == 'assistant' %}\n        {{- ' ' + message['content'] + eos_token}}\n    {%- else %}\n        {{- raise_exception('Only user and assistant roles are supported, with the exception of an initial optional system message!') }}\n    {%- endif %}\n{%- endfor %}\n",
  "clean_up_tokenization_spaces": false,
  "eos_token": "</s>",
  "legacy": false,
  "model_max_length": 1000000000000000019884624838656,
  "pad_token": null,
  "sp_model_kwargs": {},
  "spaces_between_special_tokens": false,
  "tokenizer_class": "LlamaTokenizer",
  "unk_token": "<unk>",
  "use_default_system_prompt": false
 }
		`@@ -0,0 +1 @@`
							`{"framework": "pytorch", "task": "text-generation", "allow_remote": true}`