CodeLlama-7b-hf-FP8 / generation_config.json
PY-AI-Dev's picture
Add FP8 (dynamic) quantization for CodeLlama-7b-hf
69db612 verified
Raw
History Blame Contribute Delete
111 Bytes
{
"_from_model_config": true,
"bos_token_id": 1,
"eos_token_id": 2,
"transformers_version": "5.14.1"
}