4-bit Quantization of the Qwen3 30B A3B Thinking 2507 Model
Quantized using GPTQModel
quantiziation config:
quant_config = QuantizeConfig(
bits=4,
group_size=32,
sym=True,
desc_act=False,
true_sequential=True,
pack_dtype=torch.int32,
damp_percent=0.1
)