license, datasets, language, base_model, pipeline_tag, library_name, new_version
license datasets language base_model pipeline_tag library_name new_version
apache-2.0
qikp/reborn-5k-no-thoughts
HuggingFaceTB/smol-smoltalk
HuggingFaceTB/everyday-conversations-llama3.1-2k
en
cerebras/Cerebras-GPT-111M
text-generation transformers qikp/hummingbird-2.5-110m

Hummingbird

🎉 You are looking at Hummingbird 2.1, which uses Cerebras-GPT instead of OpenAI's GPT-2.

Hummingbird is a Cerebras-GPT derivative trained to be conversational.

Training

The model was trained using the paged_adamw_8bit optimizer, gradient checkpointing, 500 steps, 1 batch size, and 4 gradient accumulation steps.

Datasets

The training corpus is made up of:

The train / train_sft splits were used.

Chat template

The Zephyr chat template was used.

Limitations

The model frequently outputs incorrect information, confirmation with a larger, mature model is advised.

Benchmark

This model was benchmarked and compared using embeddings. See the results here.

Description
Model synced from source: qikp/hummingbird-2.1-110m
Readme 767 KiB
Languages
Jinja 100%