commit eb9f8695d5c71edf0282796c5d10cc9aef152d12 Author: ModelHub XC Date: Wed Aug 26 10:36:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: Kquant03/TechxGenus-starcoder2-15b-instruct-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..be3518c --- /dev/null +++ b/.gitattributes @@ -0,0 +1,45 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q6-k.gguf filter=lfs diff=lfs merge=lfs -text +ggml-model-f16.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q2-k.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q3-k-m.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q3-k-s.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q4-k-m.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q4-k-s.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q5-k-m.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q5-k-s.gguf filter=lfs diff=lfs merge=lfs -text +Starcoder2-15B-model-q8-0.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..c3e4b21 --- /dev/null +++ b/README.md @@ -0,0 +1,66 @@ +--- +tags: +- code +- starcoder2 +library_name: transformers +pipeline_tag: text-generation +license: bigcode-openrail-m +--- + +

+starcoder2-instruct +

+ +### starcoder2-instruct (not my model, I just quantized it) + +We've fine-tuned starcoder2-15b with an additional 0.7 billion high-quality, code-related tokens for 3 epochs. We used DeepSpeed ZeRO 3 and Flash Attention 2 to accelerate the training process. It achieves **77.4 pass@1** on HumanEval-Python. This model operates using the Alpaca instruction format (excluding the system prompt). + +### Usage + +Here give some examples of how to use our model: + +```python +from transformers import AutoTokenizer, AutoModelForCausalLM +import torch +PROMPT = """### Instruction +{instruction} +### Response +""" +instruction = +prompt = PROMPT.format(instruction=instruction) +tokenizer = AutoTokenizer.from_pretrained("TechxGenus/starcoder2-15b-instruct") +model = AutoModelForCausalLM.from_pretrained( + "TechxGenus/starcoder2-15b-instruct", + torch_dtype=torch.bfloat16, + device_map="auto", +) +inputs = tokenizer.encode(prompt, return_tensors="pt") +outputs = model.generate(input_ids=inputs.to(model.device), max_new_tokens=2048) +print(tokenizer.decode(outputs[0])) +``` + +With text-generation pipeline: + + +```python +from transformers import pipeline +import torch +PROMPT = """### Instruction +{instruction} +### Response +""" +instruction = +prompt = PROMPT.format(instruction=instruction) +generator = pipeline( + model="TechxGenus/starcoder2-15b-instruct", + task="text-generation", + torch_dtype=torch.bfloat16, + device_map="auto", +) +result = generator(prompt, max_length=2048) +print(result[0]["generated_text"]) +``` + +### Note + +Model may sometimes make errors, produce misleading contents, or struggle to manage tasks that are not related to coding. It has undergone very limited testing. Additional safety testing should be performed before any real-world deployments. diff --git a/Starcoder2-15B-model-q2-k.gguf b/Starcoder2-15B-model-q2-k.gguf new file mode 100644 index 0000000..70284c6 --- /dev/null +++ b/Starcoder2-15B-model-q2-k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:91f8ea23fa0a548a7ee44134cf99f46d6a752ecb1bf8ee68fbf5fbb62d9464bc +size 6192957376 diff --git a/Starcoder2-15B-model-q3-k-m.gguf b/Starcoder2-15B-model-q3-k-m.gguf new file mode 100644 index 0000000..2f95d18 --- /dev/null +++ b/Starcoder2-15B-model-q3-k-m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5e055badc7bb4b69c808bb0ed62e0ad58c689cb5d70f1e43a296288181840059 +size 8101038016 diff --git a/Starcoder2-15B-model-q3-k-s.gguf b/Starcoder2-15B-model-q3-k-s.gguf new file mode 100644 index 0000000..980ed38 --- /dev/null +++ b/Starcoder2-15B-model-q3-k-s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0631ef211ae817256b3d5b32fa48ee583c96510e535c2f1f91fd72b4037ee702 +size 6986467264 diff --git a/Starcoder2-15B-model-q4-k-m.gguf b/Starcoder2-15B-model-q4-k-m.gguf new file mode 100644 index 0000000..a79261e --- /dev/null +++ b/Starcoder2-15B-model-q4-k-m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:9cd2780a5c059a09be144da63726e259cac96c659fafe8b62fd18c8b83f02618 +size 9860188096 diff --git a/Starcoder2-15B-model-q4-k-s.gguf b/Starcoder2-15B-model-q4-k-s.gguf new file mode 100644 index 0000000..c3fe7f8 --- /dev/null +++ b/Starcoder2-15B-model-q4-k-s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f7ff81427d7d4785b64df1f1898584503d2132c6252db002769f57af2975b56c +size 9255716800 diff --git a/Starcoder2-15B-model-q5-k-m.gguf b/Starcoder2-15B-model-q5-k-m.gguf new file mode 100644 index 0000000..b124056 --- /dev/null +++ b/Starcoder2-15B-model-q5-k-m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a9ca43b8a3eacc785591ecf567ecebdfbe7e2dc5301fcb2c5037645c7ead4d1f +size 11431479232 diff --git a/Starcoder2-15B-model-q5-k-s.gguf b/Starcoder2-15B-model-q5-k-s.gguf new file mode 100644 index 0000000..cc42f8d --- /dev/null +++ b/Starcoder2-15B-model-q5-k-s.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f7fd871dcbf9b98f2fb76e6ac780d7ab9a6bb0c1af7a15604c3888dec7adad7b +size 11022043072 diff --git a/Starcoder2-15B-model-q6-k.gguf b/Starcoder2-15B-model-q6-k.gguf new file mode 100644 index 0000000..0f542ca --- /dev/null +++ b/Starcoder2-15B-model-q6-k.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ba588e173909a6268f830c3403e4be6ae6dfb6524cb86686066074c41a7f0c38 +size 13100976064 diff --git a/Starcoder2-15B-model-q8-0.gguf b/Starcoder2-15B-model-q8-0.gguf new file mode 100644 index 0000000..327731b --- /dev/null +++ b/Starcoder2-15B-model-q8-0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:274ce9e6bfd67e448ff414a178c07eb11c3c639056d8279f14f6cd5ea03dd852 +size 16965109696 diff --git a/ggml-model-f16.gguf b/ggml-model-f16.gguf new file mode 100644 index 0000000..c954e40 --- /dev/null +++ b/ggml-model-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:cfb68d46d59e1d3f4849d8398638f8c43e5ee4438b9abfda601e9b5306de5b95 +size 31923046272