File size: 902 Bytes
fcfd3ec | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 | ---
tags:
- flux
- quantization
- modelopt
- fp8
- nvfp4
- int8
license: apache-2.0
---
# Quantized FLUX.2 Klein 4B Transformer (ModelOpt)
This repo stores NVIDIA Model Optimizer checkpoints for FLUX.2 Klein 4B transformer quantization variants.
## Contents
- `fp8/transformer_modelopt.pt`
- `fp8/transformer_modelopt_meta.json`
- `w8a8/transformer_modelopt.pt`
- `w8a8/transformer_modelopt_meta.json`
- `nvfp4/transformer_modelopt.pt`
- `nvfp4/transformer_modelopt_meta.json`
## Restore into pipeline
```python
import modelopt.torch.opt as mto
from klein_pipeline import Flux2KleinPipeline
import torch
pipe = Flux2KleinPipeline.from_pretrained(
"black-forest-labs/FLUX.2-klein-4B", torch_dtype=torch.bfloat16
).to("cuda")
ckpt = "fp8/transformer_modelopt.pt" # or w8a8 / nvfp4
mto.restore(pipe.transformer, ckpt)
pipe.transformer.eval()
```
Uploaded from Modal volume `klein4B-assets`.
|