Ornith-1.5-9B-FP8 / recipe.yaml
Sohailhosseini's picture
Add FP8 quantization of ornith-ai/Ornith-1.5-9B
f5f4924 verified
Raw
History Blame Contribute Delete
409 Bytes
default_stage:
default_modifiers:
QuantizationModifier:
targets: [Linear]
ignore: [lm_head, 're:.*visual.*', 're:.*vision_tower.*', 're:.*vision_model.*', 're:.*vision.*',
're:.*multi_modal_projector.*', 're:.*merger.*', 're:.*linear_attn\.in_proj_[ab]$',
're:.*mtp.*']
scheme: FP8_DYNAMIC
bypass_divisibility_checks: false
requires_calibration_data: false