commit 364633dcba13d8dff544860885552adf4c20c35b Author: ModelHub XC Date: Tue Sep 1 15:04:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: ramankrishna10/npc-coder-1.5b-gguf Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..82d5f1c --- /dev/null +++ b/.gitattributes @@ -0,0 +1,39 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +npc-coder-1.5b-f16.gguf filter=lfs diff=lfs merge=lfs -text +npc-coder-1.5b-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text +npc-coder-1.5b-q5_k_m.gguf filter=lfs diff=lfs merge=lfs -text +npc-coder-1.5b-q8_0.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..0aefe5f --- /dev/null +++ b/README.md @@ -0,0 +1,76 @@ +--- +license: apache-2.0 +language: [en] +library_name: transformers +base_model: Qwen/Qwen2.5-Coder-1.5B-Instruct +tags: [code, reasoning, think, local, npc, laconic] +pipeline_tag: text-generation +--- + +# NPC Coder 1.5B + +A local-first coding agent with visible `` reasoning, a laconic +senior-engineer voice, and an honest-failure character (it flags uncertainty +instead of inventing APIs). Built on Qwen2.5-Coder-1.5B-Instruct. Runs on a +laptop in GGUF. + +## What it is + +- Visible step-by-step reasoning in `` blocks before answering +- Terse, here's-the-fix answers (no filler) +- Admits uncertainty on hard or obscure problems rather than hallucinating +- Stable NPC identity (does not claim to be Qwen) + +## Honest capability framing + +This is a 1.5B model. It handles easy-to-medium coding and debugging +competently and reasons visibly about them. It is NOT an olympiad-level +solver — on genuinely hard algorithmic problems the reasoning can be +incomplete, and the model is trained to SAY so rather than emit +confident-but-wrong solutions. Treat it as a fast local assistant for everyday +coding, not a replacement for a frontier model on hard problems. + +It can still be overconfident on obscure *factual trivia* (exact default +arguments, precise version numbers) — the honest-failure training mitigates +but does not eliminate this at 1.5B. Verify specifics against the docs. + +**Benchmark:** HumanEval (instruct, pass@1, greedy): **65.9%**. Measured with +`lm-eval-harness` `humaneval_instruct`. (The personality fine-tune slightly +*improved* the extractable-code rate vs. the reasoning-only stage, because +terser answers parse more cleanly.) + +## Personality behavior (held-out eval, 200 prompts) + +| behavior | result | +|---|---| +| Correct NPC identity when asked | 100% | +| No identity mention on neutral coding (over-emission) | 2.5% | +| Denies being Qwen / wrong maker | 100% | +| Flags uncertainty on unknown/obscure APIs | 100% | + +## Training + +- **Stage 1 — reasoning:** SFT on `open-r1/codeforces-cots` (decontaminated + Python subsets, fit-filtered to ≤8192 tokens so every `` trace is + complete; the filter biases toward shorter, laconic traces). 15k traces. +- **Stage 2 — voice + identity + honest-failure:** SFT with a 7k-example + personality set (gated identity, a large anti-over-emission cohort, an + honest-failure cohort, and a 1k anti-forgetting buffer of Stage-1 reasoning + data). LoRA, gentle LR, both stages merged. + +Apache 2.0 model. Reasoning data: `open-r1/codeforces-cots` (CC-BY-4.0 / ODC-By, +attributed). + +## Local use + +GGUF quants: **q4_k_m (~941 MB, laptop default)**, q5_k_m (~1.1 GB), q8_0 +(~1.6 GB), f16 (~3.1 GB). At q4_k_m, ~7 tok/s on CPU. Uses the standard ChatML +(`<|im_start|>` / `<|im_end|>`) template. + +If q4_k_m's coherence on edge cases matters to you, q5_k_m is a cleaner default. + +## Attribution & author + +Reasoning data: `open-r1/codeforces-cots` (HuggingFace Open-R1), CC-BY-4.0. +Base model: `Qwen/Qwen2.5-Coder-1.5B-Instruct`, Apache 2.0. +Author: Rama Krishna Bachu / Bottensor (Independent Research). ORCID 0009-0000-1298-0681. diff --git a/npc-coder-1.5b-f16.gguf b/npc-coder-1.5b-f16.gguf new file mode 100644 index 0000000..425275c --- /dev/null +++ b/npc-coder-1.5b-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:13b7e7b18fba6b5a96909fc12869ac81b6ef51bd5d87d43b7640b28f6cd8c87f +size 3093666656 diff --git a/npc-coder-1.5b-q4_k_m.gguf b/npc-coder-1.5b-q4_k_m.gguf new file mode 100644 index 0000000..c634a90 --- /dev/null +++ b/npc-coder-1.5b-q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5f46599a4c09289ad62d09602e2e9843244d5f0e96fea7a45d4357cf3aeecef1 +size 986045792 diff --git a/npc-coder-1.5b-q5_k_m.gguf b/npc-coder-1.5b-q5_k_m.gguf new file mode 100644 index 0000000..0499e6d --- /dev/null +++ b/npc-coder-1.5b-q5_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f5e3fb8d2fe081ccf92cc40603421298fafdd97b566da8d0552a40ed70dad787 +size 1125047648 diff --git a/npc-coder-1.5b-q8_0.gguf b/npc-coder-1.5b-q8_0.gguf new file mode 100644 index 0000000..e4014a4 --- /dev/null +++ b/npc-coder-1.5b-q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:be8a966ce79c3e5ac68ed45c642c5934517a9d747c0bfb84654d6c6ccf66d4c8 +size 1646570336