translategemma-27b-it-NVFP4A16 / quantization-provenance.json
henry1477's picture
Add NVFP4A16 text-only quantization of google/translategemma-27b-it
7992414 verified
Raw
History Blame Contribute Delete
1.01 kB
{
"baseRepo": "google/translategemma-27b-it",
"baseRevision": "7d10f0b72f89a2d0f268cea30727d8b77c0d25c2",
"scheme": "NVFP4A16",
"algorithm": "gptq",
"calibrationSamples": 512,
"textOnly": true,
"architecture": "Gemma3ForCausalLM",
"calibrationSha256": "d5e42cebbf1e5c9f05e04c84751bac3076ca8886c98cad42442115075625159c",
"calibrationSourceLanguages": [
"ar",
"bg",
"ca",
"cs",
"da",
"de",
"el",
"es",
"fi",
"fr",
"he",
"hi",
"hu",
"id",
"it",
"ja",
"ko",
"ms",
"nl",
"no",
"pl",
"pt",
"ro",
"ru",
"sv",
"th",
"tr",
"uk",
"vi",
"zh"
],
"calibrationTargetLanguages": [
"en",
"es-MX"
],
"maxSequenceLength": 2048,
"parametersBefore": 27432406640,
"parametersAfter": 27009346304,
"rtnFallbackModules": 62,
"rtnFallbackPattern": "model.layers.{0..61}.mlp.down_proj",
"checkpointSha256": "a636a4d1b71c6e0c7d8450e0d70c2ed494fa74594b4a8652c0da2f24b7f92f5c"
}