commit 3cf3e74868aa7385853d635d63fcf0c5d3a04029 Author: ModelHub XC Date: Sat Aug 29 14:48:17 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: vibhansh/Veda-8B-v1-Cognitive Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..9c650d6 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,41 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +Veda-8B-v1-MASTER.gguf filter=lfs diff=lfs merge=lfs -text +Veda-8B-v1-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +Veda-8B-v1-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Veda-8B-v1-IQ4_XS.gguf filter=lfs diff=lfs merge=lfs -text +Veda-8B-v1-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +Veda-8B-v1.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..a894cc4 --- /dev/null +++ b/README.md @@ -0,0 +1,137 @@ +--- +language: +- en +license: llama3 +tags: +- llama +- coding +- reasoning +- logic +- gguf +base_model: meta-llama/Meta-Llama-3-8B-Instruct +pipeline_tag: text-generation +--- + +
+ +# 💠 VEDA-8B-v1-COGNITIVE + +### *Fine-tuned to think. Not just predict.* + +![](https://img.shields.io/badge/Base-Llama--3--8B-blue?style=for-the-badge) +![](https://img.shields.io/badge/Method-LoRA-green?style=for-the-badge) +![](https://img.shields.io/badge/Format-GGUF-orange?style=for-the-badge) +![](https://img.shields.io/badge/Context-8192_tokens-purple?style=for-the-badge) + +**By Vibhansh Bamnia · 18 · Independent AI Developer · Rajasthan, India** + +[🚀 Try Demo](https://huggingface.co/spaces/vibhansh/Veda-Chat) · [📥 Download Model](#-quantization) + +
+ +--- + +## ⚡ Why Veda-8B? + +> Most 8B models pattern-match. Veda-8B **reasons.** + +LoRA fine-tuned on open-source reasoning datasets — built specifically to solve where standard Llama-3 fails. + +| Capability | Standard Llama-3-8B | Veda-8B-v1 | +|---|:---:|:---:| +| Relational Chain Reasoning | ⚠️ Often fails | ✅ Reliable | +| Multi-hop Logic | ⚠️ Inconsistent | ✅ Strong | +| Code Hallucination | ❌ Common | ✅ Reduced | +| Chain-of-Thought | ⚠️ Partial | ✅ Complete | + +--- + +## 🧠 See It In Action + +
+🔗 Relational Reasoning + +**Prompt:** `A is B's father. C is A's sister. D is C's son. What is D's relation to B?` + +**Veda-8B:** +``` +A is B's father → C is B's aunt → D is C's son +∴ D is B's cousin. +``` +
+ +
+🔣 Logic Syllogism + +**Prompt:** `All Bloops are Razzies. All Razzies are Lazzies. Are all Bloops Lazzies?` + +**Veda-8B:** +``` +Bloops ⊆ Razzies ⊆ Lazzies +∴ Yes — by transitivity, all Bloops are definitely Lazzies. +``` +
+ +
+💻 Code (No Hallucination) + +**Prompt:** `Second largest unique number without sort()` + +**Veda-8B:** +```python +def second_largest(nums): + unique = set(nums) + if len(unique) < 2: + return None + first = second = float('-inf') + for n in unique: + if n > first: + second, first = first, n + elif n > second: + second = n + return second +``` +
+ +--- + +## 💎 Quantization + +| Version | Size | RAM | Use | +|:---:|:---:|:---:|:---| +| 🥇 Q4_K_M | 4.92 GB | 8 GB | Local dev, edge | +| 🥈 Q8_0 | 8.54 GB | 16 GB | Production | +| 🔬 F16 | 16 GB+ | 32 GB | Research | + +--- + +## 💻 Quick Start + +```python +import llama_cpp + +llm = llama_cpp.Llama(model_path="./Veda-8B-v1-Q4_K_M.gguf", n_ctx=8192, n_threads=4) + +response = llm("A is taller than B. B is taller than C. Is A taller than C?", + max_tokens=512, temperature=0.1) +``` + +--- + +## ⚠️ Limitations + +- Inherits Llama-3-8B base limitations +- Not for real-time / factual queries +- Verify math-heavy outputs +- Multilingual not tested + +--- + +
+ +*No institution. No GPU cluster. No team.* +*Just a focused fine-tune built to make small models reason correctly.* + +**Veda AI Labs** · [HuggingFace](https://huggingface.co/vibhansh) + +
diff --git a/Veda-8B-v1-IQ4_XS.gguf b/Veda-8B-v1-IQ4_XS.gguf new file mode 100644 index 0000000..f93dcf9 --- /dev/null +++ b/Veda-8B-v1-IQ4_XS.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1ed27af2cb3a7b8a3a8a14ae7bdee7a28a3190bda5a0de35ea2c6e1c6aa7f2ed +size 4484367744 diff --git a/Veda-8B-v1-MASTER.gguf b/Veda-8B-v1-MASTER.gguf new file mode 100644 index 0000000..a7cb85b --- /dev/null +++ b/Veda-8B-v1-MASTER.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c948d8046211dc13a5a10fbe1102921ad8c028fc92cd72f1c7b853d9ad1a623a +size 16068896160 diff --git a/Veda-8B-v1-Q3_K_M.gguf b/Veda-8B-v1-Q3_K_M.gguf new file mode 100644 index 0000000..91b28ac --- /dev/null +++ b/Veda-8B-v1-Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:1741d1ad299a0740d5b601311871b107e786fc058c63f8feb3586224b3b75652 +size 4018922880 diff --git a/Veda-8B-v1-Q4_K_M.gguf b/Veda-8B-v1-Q4_K_M.gguf new file mode 100644 index 0000000..b867f72 --- /dev/null +++ b/Veda-8B-v1-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c29a8b516f2391ea081755d93a601b3e0e0aaacfd9766f4b53e92b3281d47bd7 +size 4920739200 diff --git a/Veda-8B-v1-Q8_0.gguf b/Veda-8B-v1-Q8_0.gguf new file mode 100644 index 0000000..f89b3ad --- /dev/null +++ b/Veda-8B-v1-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:40036669867f46dbd5f785945f89edbf86f79f8055eda976ce10688d0ad59d23 +size 8540775808 diff --git a/Veda-8B-v1.gguf b/Veda-8B-v1.gguf new file mode 100644 index 0000000..a7cb85b --- /dev/null +++ b/Veda-8B-v1.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c948d8046211dc13a5a10fbe1102921ad8c028fc92cd72f1c7b853d9ad1a623a +size 16068896160 diff --git a/config.json b/config.json new file mode 100644 index 0000000..7a9407c --- /dev/null +++ b/config.json @@ -0,0 +1,16 @@ +{ + "architectures": [ + "LlamaForCausalLM" + ], + "model_type": "llama", + "num_hidden_layers": 32, + "hidden_size": 4096, + "intermediate_size": 14336, + "num_attention_heads": 32, + "num_key_value_heads": 8, + "torch_dtype": "bfloat16", + "vocab_size": 128256, + "rms_norm_eps": 1e-05, + "rope_theta": 500000.0, + "max_position_embeddings": 131072 +} \ No newline at end of file