From 660dc7647ad2002a29c5ebc08528f6774446ad51 Mon Sep 17 00:00:00 2001 From: ModelHub XC Date: Sun, 2 Aug 2026 12:05:16 +0800 Subject: [PATCH] =?UTF-8?q?=E5=88=9D=E5=A7=8B=E5=8C=96=E9=A1=B9=E7=9B=AE?= =?UTF-8?q?=EF=BC=8C=E7=94=B1ModelHub=20XC=E7=A4=BE=E5=8C=BA=E6=8F=90?= =?UTF-8?q?=E4=BE=9B=E6=A8=A1=E5=9E=8B?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Model: North-ML1/willow-alpha-gguf Source: Original Platform --- .gitattributes | 37 +++++++++++ README.md | 154 +++++++++++++++++++++++++++++++++++++++++++ forge-1v-f16.gguf | 3 + forge-1v-q4_k_m.gguf | 3 + 4 files changed, 197 insertions(+) create mode 100644 .gitattributes create mode 100644 README.md create mode 100644 forge-1v-f16.gguf create mode 100644 forge-1v-q4_k_m.gguf diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..840eac6 --- /dev/null +++ b/.gitattributes @@ -0,0 +1,37 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +forge-1v-f16.gguf filter=lfs diff=lfs merge=lfs -text +forge-1v-q4_k_m.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..d89b12f --- /dev/null +++ b/README.md @@ -0,0 +1,154 @@ +--- +license: mit +tags: +- llama +- pytorch +- causal-lm +- base-model +- north-ml +- forge +- willow-alpha +language: +- en +pipeline_tag: text-generation +--- + +

+ Willow Alpha +

+ +

+ An early-stage version of Forge-1V +

+ +

+ Small language model research by North ML. +

+ +--- + +## Overview + +**Willow Alpha** is an early-stage base model checkpoint in the **Forge-1V** model line. + +This model is currently experimental and should be treated as a research checkpoint rather than a polished assistant model. It is useful for testing architecture, pretraining quality, tokenizer behavior, evaluation pipelines, and future SFT/RLHF improvements. + +--- + +## Model Details + +| Field | Value | +|---|---| +| Model name | Willow Alpha | +| Project | Forge-1V | +| Organization | North ML | +| Model type | Causal Language Model | +| Language | English | +| License | MIT | +| Status | Early-stage / Alpha | + +--- + +## Evaluation Results + +All benchmarks below were run in **0-shot** mode. + +| Benchmark | Metric | Score | Runtime | +|---|---:|---:|---:| +| HellaSwag | acc_norm | 26.71% | 318.67s | +| PIQA | acc_norm | 53.86% | 38.85s | +| WinoGrande | acc | 50.67% | 23.73s | +| BoolQ | acc | 40.21% | 144.80s | +| ARC-Easy | acc_norm | 34.68% | 51.41s | +| ARC-Challenge | acc_norm | 25.60% | 37.69s | +| OpenBookQA | acc_norm | 25.00% | 21.14s | +| CommonsenseQA | acc | 20.31% | 27.66s | +| LAMBADA | acc | 0.23% | 96.28s | +| BLiMP | acc | 59.23% | 354.79s | +| MMLU | acc | 23.89% | 388.62s | +| WikiText-2 | word_perplexity | 12524.42 | 182.89s | +| WikiText-2 | byte_perplexity | 5.84 | 181.42s | +| SciQ | acc_norm | 35.60% | 87.15s | +| COPA | acc | 64.00% | 17.21s | +| RACE | acc | 23.16% | 334.70s | +| SWAG | acc_norm | 29.13% | 252.00s | +| TruthfulQA MC2 | acc | 48.74% | 126.29s | + +--- + +## Evaluation Summary + +| Category | Result | +|---|---:| +| Number of completed benchmark runs | 18 | +| Successful runs | 18 | +| Failed runs | 0 | +| Best accuracy-style score | COPA — 64.00% | +| Best language-structure score | BLiMP — 59.23% | +| MMLU score | 23.89% | +| WikiText-2 byte perplexity | 5.84 | +| WikiText-2 word perplexity | 12524.42 | + +--- + +## Notes + +Willow Alpha is still in a very early stage. Some results are near-random or unstable, especially on knowledge-heavy and long-context tasks. + +The strongest early signals are: + +- **COPA:** 64.00% +- **BLiMP:** 59.23% +- **PIQA:** 53.86% +- **WinoGrande:** 50.67% +- **TruthfulQA MC2:** 48.74% + +The weakest areas are: + +- **LAMBADA** +- **WikiText-2 word perplexity** +- **CommonsenseQA** +- **MMLU** +- **RACE** + +These results suggest the model has some early reasoning and grammar signal, but still needs substantially more pretraining, higher-quality data, and post-training before being useful as a general assistant. + +--- + +## Intended Use + +Willow Alpha is intended for: + +- Research +- Benchmarking +- Pretraining experiments +- Fine-tuning experiments +- Small language model development +- Forge-1V pipeline testing + +It is **not yet recommended** for production use. + +--- + +## Limitations + +This model may: + +- Produce incorrect information +- Fail basic reasoning tasks +- Struggle with factual knowledge +- Generate repetitive or low-quality text +- Perform poorly on long-context tasks +- Require additional supervised fine-tuning + +--- + +## Citation + +```bibtex +@misc{willow-alpha, + title = {Willow Alpha}, + author = {North ML}, + year = {2026}, + note = {Early-stage Forge-1V checkpoint} +} \ No newline at end of file diff --git a/forge-1v-f16.gguf b/forge-1v-f16.gguf new file mode 100644 index 0000000..754a156 --- /dev/null +++ b/forge-1v-f16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:700984740daf89a86c4a9c60b3583590ceabbbee170404300abe98d836768745 +size 575399296 diff --git a/forge-1v-q4_k_m.gguf b/forge-1v-q4_k_m.gguf new file mode 100644 index 0000000..5b5377f --- /dev/null +++ b/forge-1v-q4_k_m.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:77c5990d5713d3f433c51841185ec22667aec156f74717d45f2c3bc636bb13fa +size 176446496