初始化项目,由ModelHub XC社区提供模型

Model: RedHatAI/Qwen3-14B-FP8-dynamic
Source: Original Platform
This commit is contained in:
ModelHub XC
2026-09-20 08:06:18 +08:00
commit bd91d11f75
16 changed files with 153001 additions and 0 deletions

11
recipe.yaml Normal file
View File

@@ -0,0 +1,11 @@
quant_stage:
quant_modifiers:
QuantizationModifier:
ignore: [lm_head]
sequential_targets: [Qwen3DecoderLayer]
config_groups:
group0:
targets: [Linear]
weights: {num_bits: 8, type: float, symmetric: true, strategy: channel, observer: mse}
input_activations: {num_bits: 8, type: float, symmetric: true, strategy: token,
dynamic: true, observer: memoryless}