commit 37c439d0de53d0898b6c1756c7aaadeab1e71c50 Author: ModelHub XC Date: Mon Aug 10 03:13:16 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: PraneetNS/EduMentor-Qwen3-4B-v2-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..fe865a6 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,39 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +edumentor-v2-f16.gguf filter=lfs diff=lfs merge=lfs -text +edumentor-v2-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +edumentor-v2-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +edumentor-v2-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..e2999ac --- /dev/null +++ b/README.md @@ -0,0 +1,169 @@ +--- +license: apache-2.0 +language: +- en +library_name: llama.cpp +pipeline_tag: text-generation +base_model: PraneetNS/EduMentor-Qwen3-4B-v2-FP16 +tags: +- gguf +- llama.cpp +- qwen3 +- engineering +- education +- mentor +- conversational +- ai +--- + +# EduMentor Qwen3 4B v2 (GGUF) + +This repository contains GGUF quantized versions of **EduMentor Qwen3 4B v2**, an AI engineering mentor designed for university students, technical learning, coding assistance, project guidance, and placement preparation. + +These models are converted from the merged FP16 checkpoint and optimized for inference with **llama.cpp**, **LM Studio**, **Ollama (GGUF import)**, **Open WebUI**, **Jan**, and other GGUF-compatible runtimes. + +--- + +# Base Model + +**FP16 Repository** + +https://huggingface.co/PraneetNS/EduMentor-Qwen3-4B-v2-FP16 + +--- + +# Available Quantizations + +| File | Size | Recommended For | +|------|------:|-----------------| +| EduMentor-Qwen3-4B-v2-F16.gguf | ~7.5 GB | Maximum quality | +| EduMentor-Qwen3-4B-v2-Q8_0.gguf | ~4.0 GB | Near-FP16 quality | +| EduMentor-Qwen3-4B-v2-Q6_K.gguf | ~3.1 GB | Best balance of quality and speed | +| EduMentor-Qwen3-4B-v2-Q4_K_M.gguf | ~2.4 GB | Fast local inference | + +--- + +# Features + +EduMentor v2 is fine-tuned for engineering education and technical mentoring. + +It supports: + +- Programming Fundamentals +- Data Structures & Algorithms +- System Design +- Machine Learning +- Deep Learning +- Large Language Models +- Electronics +- Electrical Engineering +- Mechanical Engineering +- Civil Engineering +- Mathematics +- Resume Reviews +- Internship Preparation +- Placement Preparation +- Interview Guidance +- Project Mentoring + +--- + +# Response Format + +EduMentor is optimized for multimodal tutoring systems. + +Typical responses follow the structure: + +```json +{ + "speech": "...", + "display": { + "type": "code | notes | roadmap | table | diagram", + "content": "..." + }, + "follow_up": "..." +} +``` + +This enables voice assistants to speak only natural explanations while rendering code, diagrams, or notes separately. + +--- + +# Example + +### User + +Explain Binary Search. + +### Assistant + +```json +{ + "speech": "Binary Search repeatedly divides the search interval in half, making it much faster than linear search on sorted arrays.", + + "display": { + "type": "code", + "language": "python", + "content": "def binary_search(...): ..." + }, + + "follow_up": "Would you like to understand its time complexity?" +} +``` + +--- + +# Running with llama.cpp + +```bash +./llama-cli \ +-m EduMentor-Qwen3-4B-v2-Q4_K_M.gguf \ +-c 4096 \ +-p "Explain recursion simply." +``` + +--- + +# Recommended Quantization + +| Hardware | Recommendation | +|-----------|---------------| +| 8 GB RAM | Q4_K_M | +| 16 GB RAM | Q6_K | +| 24 GB+ RAM | Q8_0 | +| GPU Servers | F16 | + +--- + +# Limitations + +EduMentor may occasionally: + +- produce incorrect technical information +- require verification for safety-critical engineering tasks +- generate imperfect JSON formatting for complex prompts +- benefit from retrieval augmentation for rapidly changing topics + +The model should not replace professional engineering advice. + +--- + +# Training + +Base Architecture: + +- Qwen3-4B + +Fine-tuning: + +- Supervised Fine-Tuning (LoRA) +- Fully merged into FP16 +- Converted to GGUF using llama.cpp + +--- + +# Creator + +**Praneet N S** + +EduMentor is an ongoing effort to build an AI mentor capable of providing high-quality engineering education through natural conversations and voice-first tutoring systems. \ No newline at end of file diff --git a/edumentor-v2-Q4_K_M.gguf b/edumentor-v2-Q4_K_M.gguf new file mode 100644 index 0000000..e9448b3 --- /dev/null +++ b/edumentor-v2-Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:190dc7aa1d97c774dd080651724cac299669dd49edff5c26bb003e4833823cde +size 2497280800 diff --git a/edumentor-v2-Q6_K.gguf b/edumentor-v2-Q6_K.gguf new file mode 100644 index 0000000..e61715c --- /dev/null +++ b/edumentor-v2-Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e5760601197ccdecc3ad47bb1bf1916c05f6c8bb42ced3397c61e9157ce3bf50 +size 3306261280 diff --git a/edumentor-v2-Q8_0.gguf b/edumentor-v2-Q8_0.gguf new file mode 100644 index 0000000..a7b9e6f --- /dev/null +++ b/edumentor-v2-Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:efe3ea5169bd64b7f4324e0451d15d1e032ed179140a6561bc4bc1bb5ae578c8 +size 4280405280 diff --git a/edumentor-v2-f16.gguf b/edumentor-v2-f16.gguf new file mode 100644 index 0000000..b336092 --- /dev/null +++ b/edumentor-v2-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6f907a2c4450e052d97eeaec0b54e0bb8feba3be33ead61f0ab51da2504c58f6 +size 8051285280