初始化项目,由ModelHub XC社区提供模型
Model: fbolzan/BZN-LLM-v1 Source: Original Platform
This commit is contained in:
42
README.md
Normal file
42
README.md
Normal file
@@ -0,0 +1,42 @@
|
||||
---
|
||||
language:
|
||||
- pt
|
||||
- en
|
||||
tags:
|
||||
- bzn
|
||||
- code
|
||||
- qwen2.5
|
||||
license: apache-2.0
|
||||
library_name: transformers
|
||||
pipeline_tag: text-generation
|
||||
---
|
||||
|
||||
# BZN-LLM-v1
|
||||
|
||||
Modelo de linguagem proprietário desenvolvido por Fernando Bolzan, especializado em código e raciocínio.
|
||||
Não temos detalhes públicos sobre arquitetura interna ou dados exatos de treinamento.
|
||||
|
||||
- **Base:** Qwen2.5-Coder-7B-Instruct (Apache 2.0)
|
||||
- **Treinamento:** QLoRA
|
||||
- **Hardware:** RTX 3060 12GB
|
||||
- **Formatos:**
|
||||
- `safetensors` (Transformers)
|
||||
- `bzn-llm-v1-bf16.gguf` (15.2 GB - Qualidade Máxima)
|
||||
- `bzn-llm-v1-q5_k_m.gguf` (5.2 GB - Alta Qualidade, Leve)
|
||||
- `bzn-llm-v1-q4_k_m.gguf` (4.5 GB - Bom custo-benefício)
|
||||
|
||||
### Uso com Ollama
|
||||
|
||||
Para usar a versão GGUF diretamente no Ollama (0.30+):
|
||||
|
||||
```bash
|
||||
ollama run hf.co/fbolzan/BZN-LLM-v1
|
||||
```
|
||||
|
||||
### Uso com Transformers
|
||||
|
||||
```python
|
||||
from transformers import AutoModelForCausalLM, AutoTokenizer
|
||||
model = AutoModelForCausalLM.from_pretrained("fbolzan/BZN-LLM-v1")
|
||||
tokenizer = AutoTokenizer.from_pretrained("fbolzan/BZN-LLM-v1")
|
||||
```
|
||||
Reference in New Issue
Block a user