Model: amadeusai/Amadeus-Verbo-MI-Qwen-2.5-3B-PT-BR-Instruct-Experimental Source: Original Platform
18 lines
396 B
YAML
18 lines
396 B
YAML
|
|
slices:
|
|
- sources:
|
|
- model: Qwen/Qwen2.5-3B-Instruct
|
|
layer_range: [0, 36]
|
|
- model: amadeusai/AV-BI-Qwen2.5-3B-PT-BR-Instruct
|
|
layer_range: [0, 36]
|
|
merge_method: slerp
|
|
base_model: Qwen/Qwen2.5-3B-Instruct
|
|
parameters:
|
|
t:
|
|
- filter: self_attn
|
|
value: [0, 0.5, 0.3, 0.7, 1]
|
|
- filter: mlp
|
|
value: [1, 0.5, 0.7, 0.3, 0]
|
|
- value: 0.5
|
|
dtype: bfloat16
|