commit 6fb19fabed7a65ac54f9b21f4f07344a45b9c361 Author: ModelHub XC Date: Sat Jul 18 00:12:10 2026 +0800 初始化项目,由ModelHub XC社区提供模型 Model: brittlewis12/h2o-danube-1.8b-chat-GGUF Source: Original Platform diff --git a/.gitattributes b/.gitattributes new file mode 100644 index 0000000..1e5e08f --- /dev/null +++ b/.gitattributes @@ -0,0 +1,46 @@ +*.7z filter=lfs diff=lfs merge=lfs -text +*.arrow filter=lfs diff=lfs merge=lfs -text +*.bin filter=lfs diff=lfs merge=lfs -text +*.bz2 filter=lfs diff=lfs merge=lfs -text +*.ckpt filter=lfs diff=lfs merge=lfs -text +*.ftz filter=lfs diff=lfs merge=lfs -text +*.gz filter=lfs diff=lfs merge=lfs -text +*.h5 filter=lfs diff=lfs merge=lfs -text +*.joblib filter=lfs diff=lfs merge=lfs -text +*.lfs.* filter=lfs diff=lfs merge=lfs -text +*.mlmodel filter=lfs diff=lfs merge=lfs -text +*.model filter=lfs diff=lfs merge=lfs -text +*.msgpack filter=lfs diff=lfs merge=lfs -text +*.npy filter=lfs diff=lfs merge=lfs -text +*.npz filter=lfs diff=lfs merge=lfs -text +*.onnx filter=lfs diff=lfs merge=lfs -text +*.ot filter=lfs diff=lfs merge=lfs -text +*.parquet filter=lfs diff=lfs merge=lfs -text +*.pb filter=lfs diff=lfs merge=lfs -text +*.pickle filter=lfs diff=lfs merge=lfs -text +*.pkl filter=lfs diff=lfs merge=lfs -text +*.pt filter=lfs diff=lfs merge=lfs -text +*.pth filter=lfs diff=lfs merge=lfs -text +*.rar filter=lfs diff=lfs merge=lfs -text +*.safetensors filter=lfs diff=lfs merge=lfs -text +saved_model/**/* filter=lfs diff=lfs merge=lfs -text +*.tar.* filter=lfs diff=lfs merge=lfs -text +*.tar filter=lfs diff=lfs merge=lfs -text +*.tflite filter=lfs diff=lfs merge=lfs -text +*.tgz filter=lfs diff=lfs merge=lfs -text +*.wasm filter=lfs diff=lfs merge=lfs -text +*.xz filter=lfs diff=lfs merge=lfs -text +*.zip filter=lfs diff=lfs merge=lfs -text +*.zst filter=lfs diff=lfs merge=lfs -text +*tfevents* filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q2_K.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q3_K_L.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q3_K_M.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q3_K_S.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q4_K_M.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q4_K_S.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q5_K_M.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q5_K_S.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q6_K.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.Q8_0.gguf filter=lfs diff=lfs merge=lfs -text +h2o-danube-1.8b-chat.fp16.gguf filter=lfs diff=lfs merge=lfs -text diff --git a/README.md b/README.md new file mode 100644 index 0000000..c306f60 --- /dev/null +++ b/README.md @@ -0,0 +1,93 @@ +--- +base_model: h2oai/h2o-danube-1.8b-chat +datasets: + - HuggingFaceH4/ultrafeedback_binarized + - Intel/orca_dpo_pairs + - argilla/distilabel-math-preference-dpo + - Open-Orca/OpenOrca + - OpenAssistant/oasst2 + - HuggingFaceH4/ultrachat_200k + - meta-math/MetaMathQA +license: apache-2.0 +language: +- en +model_creator: h2oai +model_name: h2o-danube-1.8b-chat +model_type: mistral +inference: false +tags: + - gpt + - llm + - large language model + - h2o-llmstudio +pipeline_tag: text-generation +prompt_template: | + <|system|>{{system_message}} + <|prompt|>{{prompt}} + <|answer|> + +quantized_by: brittlewis12 +--- + +# h2o-danube-1.8b-chat GGUF + + +Original model: [h2o-danube-1.8b-chat](https://huggingface.co/h2oai/h2o-danube-1.8b-chat) +Model creator: [h2oai](https://huggingface.co/h2oai) + +This repo contains GGUF format model files for h2oai’s h2o-danube-1.8b-chat. + +> h2o-danube-1.8b-chat is an chat fine-tuned model by H2O.ai with 1.8 billion parameters. For details, please refer to our [Technical Report](https://arxiv.org/abs/2401.16818). We release three versions of this model: +> +> - h2oai/h2o-danube-1.8b-base Base model +> - h2oai/h2o-danube-1.8b-sft SFT tuned +> - h2oai/h2o-danube-1.8b-chat SFT + DPO tuned + +> We adjust the Llama 2 architecture for a total of around 1.8b parameters. We use the original Llama 2 tokenizer with a vocabulary size of 32,000 and train our model up to a context length of 16,384. We incorporate the sliding window attention from mistral with a size of 4,096. + +Refer to h2o.ai’s model [disclaimer](https://huggingface.co/h2oai/h2o-danube-1.8b-chat/blob/main/README.md#disclaimer) for terms of use. + + +### What is GGUF? + +GGUF is a file format for representing AI models. It is the third version of the format, introduced by the llama.cpp team on August 21st 2023. It is a replacement for GGML, which is no longer supported by llama.cpp. +Converted using llama.cpp b2037 ([1cfb537](https://github.com/ggerganov/llama.cpp/commits/1cfb5372cf5707c8ec6dde7c874f4a44a6c4c915)) + +### Prompt template: + +``` +<|system|>{{system_message}} +<|prompt|>{{prompt}} +<|answer|> +``` + +--- + +## Download & run with [cnvrs](https://twitter.com/cnvrsai) on iPhone, iPad, and Mac! + +![cnvrs.ai](https://pbs.twimg.com/profile_images/1744049151241797632/0mIP-P9e_400x400.jpg) + +[cnvrs](https://testflight.apple.com/join/sFWReS7K) is the best app for private, local AI on your device: +- create & save **Characters** with custom system prompts & temperature settings +- download and experiment with any **GGUF model** you can [find on HuggingFace](https://huggingface.co/models?library=gguf)! +- make it your own with custom **Theme colors** +- powered by Metal ⚡️ & [Llama.cpp](https://github.com/ggerganov/llama.cpp), with **haptics** during response streaming! +- **try it out** yourself today, on [Testflight](https://testflight.apple.com/join/sFWReS7K)! +- follow [cnvrs on twitter](https://twitter.com/cnvrsai) to stay up to date + +--- + +## Original Model Evaluations: + +> Commonsense, world-knowledge and reading comprehension tested in 0-shot: + +| Benchmark | acc_n | +|:--------------|:--------:| +| ARC-easy | 67.51 | +| ARC-challenge | 39.25 | +| BoolQ | 77.89 | +| Hellaswag | 67.60 | +| OpenBookQA | 39.20 | +| PiQA | 76.71 | +| TriviaQA | 36.29 | +| Winogrande | 65.35 | diff --git a/h2o-danube-1.8b-chat.Q2_K.gguf b/h2o-danube-1.8b-chat.Q2_K.gguf new file mode 100644 index 0000000..4541544 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q2_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5a03bc46300e99b237876bfcf25d6ebe82aa02b089e390b36ec010b94d418be5 +size 710702208 diff --git a/h2o-danube-1.8b-chat.Q3_K_L.gguf b/h2o-danube-1.8b-chat.Q3_K_L.gguf new file mode 100644 index 0000000..06bba5f --- /dev/null +++ b/h2o-danube-1.8b-chat.Q3_K_L.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:dd999924b26d7cd2ed95c0ce24a4191befb80ce10cb391a57bffc636ae608102 +size 980203648 diff --git a/h2o-danube-1.8b-chat.Q3_K_M.gguf b/h2o-danube-1.8b-chat.Q3_K_M.gguf new file mode 100644 index 0000000..659a552 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q3_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:52326697452cdf4257373797a408114833748c3fc71be1d992e00b8fd2fa929f +size 905164928 diff --git a/h2o-danube-1.8b-chat.Q3_K_S.gguf b/h2o-danube-1.8b-chat.Q3_K_S.gguf new file mode 100644 index 0000000..843ee19 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q3_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:84f669db1736e7c171f7e01647501bef55464e8301c98f4750d04bbe2d08ea4d +size 820029568 diff --git a/h2o-danube-1.8b-chat.Q4_K_M.gguf b/h2o-danube-1.8b-chat.Q4_K_M.gguf new file mode 100644 index 0000000..015dc05 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q4_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:79f276f9be5c99b44137e939a12ad91775b01d5f298067b378969c8fe0b66c6b +size 1112151168 diff --git a/h2o-danube-1.8b-chat.Q4_K_S.gguf b/h2o-danube-1.8b-chat.Q4_K_S.gguf new file mode 100644 index 0000000..d3af64d --- /dev/null +++ b/h2o-danube-1.8b-chat.Q4_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:033a3972764f0f67c14d12e2c0e5bc9c012309ca79582f5af497bb145e9d1bd1 +size 1059794048 diff --git a/h2o-danube-1.8b-chat.Q5_K_M.gguf b/h2o-danube-1.8b-chat.Q5_K_M.gguf new file mode 100644 index 0000000..804221c --- /dev/null +++ b/h2o-danube-1.8b-chat.Q5_K_M.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ffd38b115ff9a1d8ba97936d2f91bedf90632979ab8b5c303d06d03e23545753 +size 1301795968 diff --git a/h2o-danube-1.8b-chat.Q5_K_S.gguf b/h2o-danube-1.8b-chat.Q5_K_S.gguf new file mode 100644 index 0000000..fc0f946 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q5_K_S.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6512d2e1d697d4689969885bcfa546529596424a2d9b1d7f0a29c16fa4eebde8 +size 1270983808 diff --git a/h2o-danube-1.8b-chat.Q6_K.gguf b/h2o-danube-1.8b-chat.Q6_K.gguf new file mode 100644 index 0000000..677a1f1 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q6_K.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ed55bf76d10bff0c06a7ad5cc5a683ecf85524a303233af119c8f69e8b0e4d0f +size 1503293568 diff --git a/h2o-danube-1.8b-chat.Q8_0.gguf b/h2o-danube-1.8b-chat.Q8_0.gguf new file mode 100644 index 0000000..7554af7 --- /dev/null +++ b/h2o-danube-1.8b-chat.Q8_0.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5f4c6c1a0a4f140a35a4c999bc25351167d2a39cd2ef91d487a4d99753c910e5 +size 1946757248 diff --git a/h2o-danube-1.8b-chat.fp16.gguf b/h2o-danube-1.8b-chat.fp16.gguf new file mode 100644 index 0000000..154e094 --- /dev/null +++ b/h2o-danube-1.8b-chat.fp16.gguf @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:54766edc5ab5df0b05f32337614948e71c37835471060543a9ca83936f74ddea +size 3663390784