quant-FLUX2-klein4B-modelopt / w8a8 /transformer_modelopt_meta.json
Yuvrajxms09's picture
Upload ModelOpt quantized FLUX.2 Klein 4B transformer variants
fcfd3ec verified
Raw History Blame Contribute Delete
403 Bytes
{
"model_id": "/models/FLUX.2-klein-4B",
"component": "transformer",
"backend": "nvidia-modelopt",
"config": "INT8_SMOOTHQUANT_CFG",
"variant": "w8a8",
"dtype": "torch.bfloat16",
"calibration": {
"iters": 8,
"batch_size": 1,
"image_path": "/models/calib/blue_car_resize.jpeg",
"steps": 4,
"height": 576,
"width": 384,
"guidance_scale": 4.0
},
"version": 1
}