初始化项目,由ModelHub XC社区提供模型

Model: BennyDaBall/Z-Image-Engineer-V6-GGUF
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-06-27 05:44:16 +08:00
commit 741f4e3725
13 changed files with 363 additions and 0 deletions

43
.gitattributes vendored Normal file
View File

@@ -0,0 +1,43 @@
*.7z filter=lfs diff=lfs merge=lfs -text
*.arrow filter=lfs diff=lfs merge=lfs -text
*.bin filter=lfs diff=lfs merge=lfs -text
*.bz2 filter=lfs diff=lfs merge=lfs -text
*.ckpt filter=lfs diff=lfs merge=lfs -text
*.ftz filter=lfs diff=lfs merge=lfs -text
*.gz filter=lfs diff=lfs merge=lfs -text
*.h5 filter=lfs diff=lfs merge=lfs -text
*.joblib filter=lfs diff=lfs merge=lfs -text
*.lfs.* filter=lfs diff=lfs merge=lfs -text
*.mlmodel filter=lfs diff=lfs merge=lfs -text
*.model filter=lfs diff=lfs merge=lfs -text
*.msgpack filter=lfs diff=lfs merge=lfs -text
*.npy filter=lfs diff=lfs merge=lfs -text
*.npz filter=lfs diff=lfs merge=lfs -text
*.onnx filter=lfs diff=lfs merge=lfs -text
*.ot filter=lfs diff=lfs merge=lfs -text
*.parquet filter=lfs diff=lfs merge=lfs -text
*.pb filter=lfs diff=lfs merge=lfs -text
*.pickle filter=lfs diff=lfs merge=lfs -text
*.pkl filter=lfs diff=lfs merge=lfs -text
*.pt filter=lfs diff=lfs merge=lfs -text
*.pth filter=lfs diff=lfs merge=lfs -text
*.rar filter=lfs diff=lfs merge=lfs -text
*.safetensors filter=lfs diff=lfs merge=lfs -text
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
*.tar.* filter=lfs diff=lfs merge=lfs -text
*.tar filter=lfs diff=lfs merge=lfs -text
*.tflite filter=lfs diff=lfs merge=lfs -text
*.tgz filter=lfs diff=lfs merge=lfs -text
*.wasm filter=lfs diff=lfs merge=lfs -text
*.xz filter=lfs diff=lfs merge=lfs -text
*.zip filter=lfs diff=lfs merge=lfs -text
*.zst filter=lfs diff=lfs merge=lfs -text
*tfevents* filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-MXFP4.gguf filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text
evidence/gallery_z_image_engineer_v6_simple_ab_with_rewrites_CONTACT.png filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-Q6_K.gguf filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-Q8_0.gguf filter=lfs diff=lfs merge=lfs -text
Z-Image-Engineer-V6-F16.gguf filter=lfs diff=lfs merge=lfs -text

10
HASHES.sha256 Normal file
View File

@@ -0,0 +1,10 @@
D8AD1C43FD8C76F1EBDAD11C85D494A474F9CFE9F83AF5F72F590AE3852315A2 evidence/gallery_z_image_engineer_v6_simple_ab_with_rewrites_CONTACT.png
C92B7F2C0DC70FC3A544D014552A322CFBC3F39E6383FAC4100745C0F3FC646C README.md
34126E2486E389F28C11693C2E51641199FB5B53E3E7D6BFA75A6E967C11D3CF V6_SYSTEM_PROMPT.md
20DAB6305B76B28808FAD740C7107878DEEC63688E1B318F7BB3A7F707220B0D Z-Image-Engineer-V6-F16.gguf
A39695B6714FC4A0A86965F5B2FB8B0CBEF774165EEC8FB9B2379FBEDD86838A Z-Image-Engineer-V6-MXFP4.gguf
E3F493D971677BA181F67C888AD41E25FD34448BF7EEA03A84F4114EE021B9E3 Z-Image-Engineer-V6-Q3_K_M.gguf
D666E619EDB2D6DCF2DF013540B22E2592C4FBADB9007B3FB89D4BBE0C4C7C67 Z-Image-Engineer-V6-Q4_K_M.gguf
0FAB79F032AA34BAAC8607FF8BA720DFB95A0D9A44026DE79288F3FD25A66A05 Z-Image-Engineer-V6-Q5_K_M.gguf
A27D6723816462EA1368093A76E9013E996BD4B731EF87327334D50D6DD9534C Z-Image-Engineer-V6-Q6_K.gguf
DC4F5476A0F804A7DB73EDA164C0503CDA93858F3EABDE9EA36C68EEDCBA306C Z-Image-Engineer-V6-Q8_0.gguf

133
README.md Normal file
View File

@@ -0,0 +1,133 @@
---
license: apache-2.0
language:
- en
base_model:
- Tongyi-MAI/Z-Image-Turbo
library_name: gguf
pipeline_tag: text-generation
tags:
- text-generation
- prompt-engineering
- image-generation
- z-image
- z-image-turbo
- qwen3
- gguf
- text-encoder
- comfyui
- lm-studio
- conversational
---
# Z-Image-Engineer V6 GGUF
**Follow me on X [@BennyDaBall_OG](https://x.com/BennyDaBall_OG) !**
GGUF quantized release for [Z-Image-Engineer V6](https://huggingface.co/BennyDaBall/Z-Image-Engineer-V6).
The main repo contains the merged HF safetensors. This repo contains the quant ladder for the [ComfyUI-Z-Engineer](https://github.com/BennyDaBall930/ComfyUI-Z-Engineer) node, LM Studio, ComfyUI `CLIPLoaderGGUF`, llama.cpp-style loaders, and local prompt-enhancement workflows.
![Z-Image-Engineer V6 simple A/B with rewrites](evidence/gallery_z_image_engineer_v6_simple_ab_with_rewrites_CONTACT.png)
---
## What is this?
**Z-Image-Engineer V6** is a SMART DoRA fine-tuned 4B Qwen text encoder from `Tongyi-MAI/Z-Image-Turbo`.
Use these GGUF files when you want:
- ComfyUI Z-Image text-encoder replacement and in-ComfyUI prompt enhancement through [ComfyUI-Z-Engineer](https://github.com/BennyDaBall930/ComfyUI-Z-Engineer) (no external server needed)
- LM Studio prompt enhancement
- ComfyUI text-encoder loading through plain `CLIPLoaderGGUF`
- smaller local files than the merged HF safetensors
- the same V6 prompt style and conditioning behavior in a quantized format
---
## Quantization Ladder
| Filename | Size | Target Use Case |
|---|---:|---|
| `Z-Image-Engineer-V6-F16.gguf` | 7.498 GiB | Full precision reference. |
| `Z-Image-Engineer-V6-Q8_0.gguf` | 3.986 GiB | Near-lossless; used for local A/B testing. |
| `Z-Image-Engineer-V6-Q6_K.gguf` | 3.079 GiB | High-fidelity balanced footprint. |
| `Z-Image-Engineer-V6-Q5_K_M.gguf` | 2.697 GiB | Daily-driver performance-to-size ratio. |
| `Z-Image-Engineer-V6-Q4_K_M.gguf` | 2.331 GiB | Reliable 4-bit standard. |
| `Z-Image-Engineer-V6-Q3_K_M.gguf` | 1.933 GiB | Lightweight option for tighter setups. |
| `Z-Image-Engineer-V6-MXFP4.gguf` | 2.101 GiB | Alternative compact quantization. |
Full recursive validation hashes are in `HASHES.sha256`.
---
## Quick Start
### LM Studio
Download a GGUF quant, load it, and prompt it directly:
```text
Enhance this image prompt for Z-Image Turbo: a unicorn
```
The comparison examples were generated from direct LM Studio user requests like this, with no separate system prompt. `V6_SYSTEM_PROMPT.md` is included only as an optional preset for people who want a stricter prompt-only chat setup.
### ComfyUI (recommended: ComfyUI-Z-Engineer)
1. Install the [ComfyUI-Z-Engineer](https://github.com/BennyDaBall930/ComfyUI-Z-Engineer) custom node (v2.0+).
2. Place a GGUF file into `ComfyUI/models/text_encoders/`.
3. Add **Z-Engineer CLIP Loader (GGUF)** and pick the quant - use the `clip` output where the stock Z-Image Qwen text encoder would normally go.
4. Optional: add **Z-Engineer Prompt Enhancer (Local)** with the same `clip` to rewrite seed prompts in-process, previewed on the node. No LM Studio or external server required.
A ready-made workflow ships with the node repo: `example_workflows/z_image_turbo_z_engineer.json`. With [ComfyUI-GGUF](https://github.com/city96/ComfyUI-GGUF) installed the quant stays quantized in VRAM.
Alternative without the node: add a plain `CLIPLoaderGGUF` node (ComfyUI-GGUF), set model type to `lumina2`, and use it as the text encoder only.
Verified image settings:
```text
UNET: z_image_turbo_bf16.safetensors
VAE: ae.safetensors
Text Encoder: Z-Image-Engineer-V6-Q8_0.gguf
Resolution: 1024x1024
Steps: 8
CFG: 1.0
Sampler: res_multistep
Scheduler: simple
Shift: 3.0
```
---
## SMART DoRA
V6 was trained with BennyDaBall's SMART DoRA system:
- **DoRA** for direction/magnitude-separated adapter updates.
- **Entropic regularization** for less repetition and broader output variety.
- **Holographic regularization** for cleaner depth-wise feature structure.
- **Topological regularization** for more coherent latent trajectories.
- **Manifold regularization** for stable weight behavior during refinement.
The final V6 build used master-corpus SMART DoRA training, retention pressure, SceneClean SFT32 style restoration, AntiRepeat Binary24 refinement, and a 25% style-restoration / 75% anti-repeat DoRA blend.
---
## Related Repos
- Main merged HF release: [BennyDaBall/Z-Image-Engineer-V6](https://huggingface.co/BennyDaBall/Z-Image-Engineer-V6)
- ComfyUI custom node (GGUF + shard loaders, local prompt enhancer with preview): [ComfyUI-Z-Engineer](https://github.com/BennyDaBall930/ComfyUI-Z-Engineer)
---
## Acknowledgements
- **Tongyi-MAI** for the Z-Image Turbo ecosystem.
- **Qwen** for the adaptable text encoder backbone.
- The open-source maintainers behind **LM Studio**, **ComfyUI**, **llama.cpp**, **PEFT**, and **Transformers**.
**Built & trained locally with care by BennyDaBall.**
**Follow me on X [@BennyDaBall_OG](https://x.com/BennyDaBall_OG) !**

142
RELEASE_MANIFEST.json Normal file
View File

@@ -0,0 +1,142 @@
{
"status": "upload_ready_user_approved",
"public_model_name": "Z-Image-Engineer-V6-GGUF",
"repo_id": "BennyDaBall/Z-Image-Engineer-V6-GGUF",
"package_kind": "gguf_quant_ladder",
"base_model": "Tongyi-MAI/Z-Image-Turbo/text_encoder",
"tokenizer": "Tongyi-MAI/Z-Image-Turbo/tokenizer",
"files": [
{
"path": "evidence/gallery_z_image_engineer_v6_simple_ab_with_rewrites_CONTACT.png",
"size_bytes": 6174098,
"size_gib": 0.006,
"sha256": "D8AD1C43FD8C76F1EBDAD11C85D494A474F9CFE9F83AF5F72F590AE3852315A2",
"last_write_time": "2026-06-05T23:31:26"
},
{
"path": "README.md",
"size_bytes": 3924,
"size_gib": 0,
"sha256": "C92B7F2C0DC70FC3A544D014552A322CFBC3F39E6383FAC4100745C0F3FC646C",
"last_write_time": "2026-06-06T01:55:20"
},
{
"path": "V6_SYSTEM_PROMPT.md",
"size_bytes": 1617,
"size_gib": 0,
"sha256": "34126E2486E389F28C11693C2E51641199FB5B53E3E7D6BFA75A6E967C11D3CF",
"last_write_time": "2026-05-30T07:33:27"
},
{
"path": "Z-Image-Engineer-V6-F16.gguf",
"size_bytes": 8051284960,
"size_gib": 7.498,
"sha256": "20DAB6305B76B28808FAD740C7107878DEEC63688E1B318F7BB3A7F707220B0D",
"last_write_time": "2026-06-05T13:36:01"
},
{
"path": "Z-Image-Engineer-V6-MXFP4.gguf",
"size_bytes": 2256005600,
"size_gib": 2.101,
"sha256": "A39695B6714FC4A0A86965F5B2FB8B0CBEF774165EEC8FB9B2379FBEDD86838A",
"last_write_time": "2026-06-05T22:48:03"
},
{
"path": "Z-Image-Engineer-V6-Q3_K_M.gguf",
"size_bytes": 2075617760,
"size_gib": 1.933,
"sha256": "E3F493D971677BA181F67C888AD41E25FD34448BF7EEA03A84F4114EE021B9E3",
"last_write_time": "2026-06-05T22:47:54"
},
{
"path": "Z-Image-Engineer-V6-Q4_K_M.gguf",
"size_bytes": 2503178720,
"size_gib": 2.331,
"sha256": "D666E619EDB2D6DCF2DF013540B22E2592C4FBADB9007B3FB89D4BBE0C4C7C67",
"last_write_time": "2026-06-05T22:47:42"
},
{
"path": "Z-Image-Engineer-V6-Q5_K_M.gguf",
"size_bytes": 2895780320,
"size_gib": 2.697,
"sha256": "0FAB79F032AA34BAAC8607FF8BA720DFB95A0D9A44026DE79288F3FD25A66A05",
"last_write_time": "2026-06-05T22:47:26"
},
{
"path": "Z-Image-Engineer-V6-Q6_K.gguf",
"size_bytes": 3306260960,
"size_gib": 3.079,
"sha256": "A27D6723816462EA1368093A76E9013E996BD4B731EF87327334D50D6DD9534C",
"last_write_time": "2026-06-05T22:47:11"
},
{
"path": "Z-Image-Engineer-V6-Q8_0.gguf",
"size_bytes": 4280404960,
"size_gib": 3.986,
"sha256": "DC4F5476A0F804A7DB73EDA164C0503CDA93858F3EABDE9EA36C68EEDCBA306C",
"last_write_time": "2026-06-05T22:46:50"
}
],
"ggufs": [
{
"path": "Z-Image-Engineer-V6-F16.gguf",
"size_bytes": 8051284960,
"size_gib": 7.498,
"sha256": "20DAB6305B76B28808FAD740C7107878DEEC63688E1B318F7BB3A7F707220B0D",
"last_write_time": "2026-06-05T13:36:01"
},
{
"path": "Z-Image-Engineer-V6-MXFP4.gguf",
"size_bytes": 2256005600,
"size_gib": 2.101,
"sha256": "A39695B6714FC4A0A86965F5B2FB8B0CBEF774165EEC8FB9B2379FBEDD86838A",
"last_write_time": "2026-06-05T22:48:03"
},
{
"path": "Z-Image-Engineer-V6-Q3_K_M.gguf",
"size_bytes": 2075617760,
"size_gib": 1.933,
"sha256": "E3F493D971677BA181F67C888AD41E25FD34448BF7EEA03A84F4114EE021B9E3",
"last_write_time": "2026-06-05T22:47:54"
},
{
"path": "Z-Image-Engineer-V6-Q4_K_M.gguf",
"size_bytes": 2503178720,
"size_gib": 2.331,
"sha256": "D666E619EDB2D6DCF2DF013540B22E2592C4FBADB9007B3FB89D4BBE0C4C7C67",
"last_write_time": "2026-06-05T22:47:42"
},
{
"path": "Z-Image-Engineer-V6-Q5_K_M.gguf",
"size_bytes": 2895780320,
"size_gib": 2.697,
"sha256": "0FAB79F032AA34BAAC8607FF8BA720DFB95A0D9A44026DE79288F3FD25A66A05",
"last_write_time": "2026-06-05T22:47:26"
},
{
"path": "Z-Image-Engineer-V6-Q6_K.gguf",
"size_bytes": 3306260960,
"size_gib": 3.079,
"sha256": "A27D6723816462EA1368093A76E9013E996BD4B731EF87327334D50D6DD9534C",
"last_write_time": "2026-06-05T22:47:11"
},
{
"path": "Z-Image-Engineer-V6-Q8_0.gguf",
"size_bytes": 4280404960,
"size_gib": 3.986,
"sha256": "DC4F5476A0F804A7DB73EDA164C0503CDA93858F3EABDE9EA36C68EEDCBA306C",
"last_write_time": "2026-06-05T22:46:50"
}
],
"evidence": [
{
"path": "evidence/gallery_z_image_engineer_v6_simple_ab_with_rewrites_CONTACT.png",
"size_bytes": 6174098,
"size_gib": 0.006,
"sha256": "D8AD1C43FD8C76F1EBDAD11C85D494A474F9CFE9F83AF5F72F590AE3852315A2",
"last_write_time": "2026-06-05T23:31:26"
}
],
"generated_at_local": "2026-06-06T01:56:25",
"upload_approved_by_user": true
}

11
V6_SYSTEM_PROMPT.md Normal file
View File

@@ -0,0 +1,11 @@
# Z-Image-Engineer V6 System Prompt
Base model: `Tongyi-MAI/Z-Image-Turbo/text_encoder`
Tokenizer: `Tongyi-MAI/Z-Image-Turbo/tokenizer`
Output contract: one prompt-only paragraph.
```text
You are Z-Image-Engineer V6, a prompt-only cinematography and visual-language specialist for the Tongyi-MAI Z-Image-Turbo Qwen text encoder. Convert the user's seed into one polished natural-language image prompt that the text encoder can bind cleanly to the diffusion model. Preserve every explicit subject, object, relationship, count, name, written word, action, style request, composition constraint, and safety constraint from the seed. Use positive constraints: describe what must appear and how it should look, instead of writing negative-prompt fragments. Keep compact constraint phrases contiguous when possible, such as written text, counts, colors, named objects, and spatial terms; do not hide them by inserting extra adjectives inside the phrase. Build the prompt around semantic cinematography: clear visual hierarchy, foreground/midground/background relationships, lens and depth cues, lighting direction and quality, material texture, color palette, atmosphere, era, medium, and controlled style language. Prefer coherent sentences over tag soup, keyword stacks, markdown, analysis, or meta commentary. Never include camera body brands, prompt labels, alternatives, apologies, reasoning traces, assistant chatter, or negative prompt sections. Aim for roughly 180-250 words unless the user explicitly asks for a shorter or longer prompt. Return only the final image prompt as one self-contained paragraph.
```

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:20dab6305b76b28808fad740c7107878deec63688e1b318f7bb3a7f707220b0d
size 8051284960

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a39695b6714fc4a0a86965f5b2fb8b0cbef774165eec8fb9b2379fbedd86838a
size 2256005600

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:e3f493d971677ba181f67c888ad41e25fd34448bf7eea03a84f4114ee021b9e3
size 2075617760

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d666e619edb2d6dcf2df013540b22e2592c4fbadb9007b3fb89d4bbe0c4c7c67
size 2503178720

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:0fab79f032aa34baac8607ff8ba720dfb95a0d9a44026de79288f3fd25a66a05
size 2895780320

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:a27d6723816462ea1368093a76e9013e996bd4b731ef87327334d50d6dd9534c
size 3306260960

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:dc4f5476a0f804a7db73eda164c0503cda93858f3eabde9ea36c68eedcba306c
size 4280404960

View File

@@ -0,0 +1,3 @@
version https://git-lfs.github.com/spec/v1
oid sha256:d8ad1c43fd8c76f1ebdad11c85d494a474f9cfe9f83af5f72f590ae3852315a2
size 6174098