43 lines
1.1 KiB
Markdown
43 lines
1.1 KiB
Markdown
---
|
|
language:
|
|
- pt
|
|
- en
|
|
tags:
|
|
- bzn
|
|
- code
|
|
- qwen2.5
|
|
license: apache-2.0
|
|
library_name: transformers
|
|
pipeline_tag: text-generation
|
|
---
|
|
|
|
# BZN-LLM-v1
|
|
|
|
Modelo de linguagem proprietário desenvolvido por Fernando Bolzan, especializado em código e raciocínio.
|
|
Não temos detalhes públicos sobre arquitetura interna ou dados exatos de treinamento.
|
|
|
|
- **Base:** Qwen2.5-Coder-7B-Instruct (Apache 2.0)
|
|
- **Treinamento:** QLoRA
|
|
- **Hardware:** RTX 3060 12GB
|
|
- **Formatos:**
|
|
- `safetensors` (Transformers)
|
|
- `bzn-llm-v1-bf16.gguf` (15.2 GB - Qualidade Máxima)
|
|
- `bzn-llm-v1-q5_k_m.gguf` (5.2 GB - Alta Qualidade, Leve)
|
|
- `bzn-llm-v1-q4_k_m.gguf` (4.5 GB - Bom custo-benefício)
|
|
|
|
### Uso com Ollama
|
|
|
|
Para usar a versão GGUF diretamente no Ollama (0.30+):
|
|
|
|
```bash
|
|
ollama run hf.co/fbolzan/BZN-LLM-v1
|
|
```
|
|
|
|
### Uso com Transformers
|
|
|
|
```python
|
|
from transformers import AutoModelForCausalLM, AutoTokenizer
|
|
model = AutoModelForCausalLM.from_pretrained("fbolzan/BZN-LLM-v1")
|
|
tokenizer = AutoTokenizer.from_pretrained("fbolzan/BZN-LLM-v1")
|
|
```
|