初始化项目,由ModelHub XC社区提供模型

Model: Pauldyu57/gemma4-cnc-ll-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-08-29 09:44:17 +08:00
commit 8869760abf
7 changed files with 128 additions and 0 deletions

39
.gitattributes vendored Normal file
View File

@@ -0,0 +1,39 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
gemma4-cnc-ll-F16.gguf filter=lfs diff=lfs merge=lfs -text
gemma4-cnc-ll-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
gemma4-cnc-ll-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
gemma4-cnc-ll-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text

20
Modelfile Normal file
View File

@@ -0,0 +1,20 @@
# Modelfile for gemma4-cnc-ll
# Usage: ollama create gemma4-cnc-ll -f Modelfile
FROM ./gemma4-cnc-ll-Q4_K_M.gguf
TEMPLATE """<start_of_turn>user
{{ if .System }}{{ .System }}
{{ end }}{{ .Prompt }}<end_of_turn>
<start_of_turn>model
{{ .Response }}<end_of_turn>
"""
PARAMETER stop "<start_of_turn>"
PARAMETER stop "<end_of_turn>"
PARAMETER temperature 0.3
PARAMETER top_p 0.9
PARAMETER repeat_penalty 1.1
PARAMETER num_ctx 8192
SYSTEM """You are an expert CNC lathe assistant for 永詮機械 (Yong Chuan / L&L Machinery). You know the work-order database schema, BOM categories, pricing models, Neo4j and SQL queries, plus L&L's 14 machine models and 6 application industries. Answer accurately in the same language as the question. If a specific spec (price, dimension, power) isn't on L&L's public website, direct the user to service@llmachinery.com.tw."""

57
README.md Normal file
View File

@@ -0,0 +1,57 @@
---
license: gemma
base_model: google/gemma-3-4b-it
library_name: gguf
tags:
- gguf
- gemma
- gemma-3
- cnc
- manufacturing
- work-order
- ll-machinery
- fine-tuned
- ollama
pipeline_tag: text-generation
---
# gemma4-cnc-ll (GGUF) — Two-stage Fine-tune
Two-stage QLoRA fine-tune of [`google/gemma-3-4b-it`](https://huggingface.co/google/gemma-3-4b-it):
**Stage 1 — Work-order knowledge**
CNC work-order database schema, BOM categories, pricing models, Neo4j/SQL queries
for 永詮機械 (Yong Chuan Machinery).
**Stage 2 — L&L 永詮 specialization** (anti-dilution training)
14 machine models (LLA/LLB/LLS/LL/LFM/LFS/LS-C/LS-S/LS-U/LD/LC/TA/MA/LA/A),
6 application industries, company background. Trained with 5 anti-dilution
mechanisms including critical-facts validation.
## Quick start (Ollama)
```bash
ollama run hf.co/Pauldyu57/gemma4-cnc-ll-GGUF:Q4_K_M
```
Other tags: `Q5_K_M`, `Q8_0`, `F16`.
If this repo is private, link your Ollama SSH key first:
```bash
cat ~/.ollama/id_ed25519.pub
# → paste into https://huggingface.co/settings/keys
```
## Files
| Quant | Approx size | Notes |
|---------|-------------|------------------------------|
| F16 | ~7.5 GB | Reference |
| Q8_0 | ~4.3 GB | Near-lossless |
| Q5_K_M | ~3.0 GB | Good quality / size balance |
| Q4_K_M | ~2.5 GB | Default for CPU / small GPUs |
## Base model
[`google/gemma-3-4b-it`](https://huggingface.co/google/gemma-3-4b-it) — usage subject to the
[Gemma Terms of Use](https://ai.google.dev/gemma/terms).

3
gemma4-cnc-ll-F16.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:b3b2e388276654610d6b22b2575a1e905bb5764ac642c0fa15a4b54e22aa1e09
size 7767803488

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e6c5333757c25a2fbc94cf66f812050a1e3b8e62394cb2b15d9f9e61fc87be30
size 2489893728

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:56d38e32e413a80279767fb126ef7282bfbb2caac0b592960754ad301cc0f214
size 2829697888

3
gemma4-cnc-ll-Q8_0.gguf Normal file
View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:f0f22d23c505eea72a527558c7196c98d17ceceff0d7b6e92025cafd6aaec331
size 4130401888