ukisai's picture
initial release
37e7e5e
Raw
History Blame Contribute Delete
1.1 kB
"""Quark recipe matching AMD's published Qwen3.8-27B AWQ configuration."""
from quark.torch.quantization.config.config import (
AWQConfig,
Int4PerGroupSpec,
QConfig,
QLayerConfig,
)
def make_config():
return QConfig(
global_quant_config=QLayerConfig(
weight=Int4PerGroupSpec(ch_axis=-1, group_size=128).to_quantization_spec()
),
exclude=["model.visual.*", "lm_head", "mtp.*"],
algo_config=[
AWQConfig(
model_decoder_layers="model.language_model.layers",
scaling_layers=[
{
"prev_op": "post_attention_layernorm",
"layers": ["mlp.gate_proj", "mlp.up_proj"],
"inp": "mlp.gate_proj",
"module2inspect": "mlp",
},
{
"prev_op": "mlp.up_proj",
"layers": ["mlp.down_proj"],
"inp": "mlp.down_proj",
},
],
)
],
)