File size: 902 Bytes
fcfd3ec
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
---
tags:
- flux
- quantization
- modelopt
- fp8
- nvfp4
- int8
license: apache-2.0
---

# Quantized FLUX.2 Klein 4B Transformer (ModelOpt)

This repo stores NVIDIA Model Optimizer checkpoints for FLUX.2 Klein 4B transformer quantization variants.

## Contents

- `fp8/transformer_modelopt.pt`
- `fp8/transformer_modelopt_meta.json`
- `w8a8/transformer_modelopt.pt`
- `w8a8/transformer_modelopt_meta.json`
- `nvfp4/transformer_modelopt.pt`
- `nvfp4/transformer_modelopt_meta.json`

## Restore into pipeline

```python
import modelopt.torch.opt as mto
from klein_pipeline import Flux2KleinPipeline
import torch

pipe = Flux2KleinPipeline.from_pretrained(
    "black-forest-labs/FLUX.2-klein-4B", torch_dtype=torch.bfloat16
).to("cuda")

ckpt = "fp8/transformer_modelopt.pt"  # or w8a8 / nvfp4
mto.restore(pipe.transformer, ckpt)
pipe.transformer.eval()
```

Uploaded from Modal volume `klein4B-assets`.