Files
Qwen2.5-7B-Agent-AWQ-v1/README.md
ModelHub XC db86b31d4e 初始化项目,由ModelHub XC社区提供模型
Model: Rarakiyo/Qwen2.5-7B-Agent-AWQ-v1
Source: Original Platform
2026-08-01 19:59:19 +08:00

557 B

base_model, language, license, library_name, pipeline_tag, tags
base_model language license library_name pipeline_tag tags
Rarakiyo/Qwen2.5-7B-Agent-v1
en
apache-2.0 transformers text-generation
awq
4bit
agent
qwen2.5

Qwen2.5-7B-Agent-AWQ-v1

AWQ 4-bit quantized model from Rarakiyo/Qwen2.5-7B-Agent-v1.

Quantization Config

  • Method: AWQ (Activation-aware Weight Quantization)
  • Bits: 4
  • Group Size: 128
  • Version: GEMM
  • Zero Point: True

Usage (vLLM)

from vllm import LLM
model = LLM(model="Rarakiyo/Qwen2.5-7B-Agent-AWQ-v1", quantization="awq")