base_model, datasets, inference, language, model_creator, model_name, pipeline_tag, quantized_by, tags
base_model datasets inference language model_creator model_name pipeline_tag quantized_by tags
SumayyaAli/tiny-llama-1.1b-chat-medical
SumayyaAli/accu_qa_dataset
false
en
SumayyaAli tiny-llama-1.1b-chat-medical text-generation afrideva
medical
gguf
ggml
quantized
q2_k
q3_k_m
q4_k_m
q5_k_m
q6_k
q8_0

SumayyaAli/tiny-llama-1.1b-chat-medical-GGUF

Quantized GGUF model files for tiny-llama-1.1b-chat-medical from SumayyaAli

Name Quant method Size
tiny-llama-1.1b-chat-medical.fp16.gguf fp16 2.20 GB
tiny-llama-1.1b-chat-medical.q2_k.gguf q2_k 483.12 MB
tiny-llama-1.1b-chat-medical.q3_k_m.gguf q3_k_m 550.82 MB
tiny-llama-1.1b-chat-medical.q4_k_m.gguf q4_k_m 668.79 MB
tiny-llama-1.1b-chat-medical.q5_k_m.gguf q5_k_m 783.02 MB
tiny-llama-1.1b-chat-medical.q6_k.gguf q6_k 904.39 MB
tiny-llama-1.1b-chat-medical.q8_0.gguf q8_0 1.17 GB

Original Model Card:

Description
Model synced from source: afrideva/tiny-llama-1.1b-chat-medical-GGUF
Readme 25 KiB