{
"format": "jang",
"format_version": "2.0",
"weight_format": "affine",
"profile": "JANG_AFFINE_TERNARY_PACKED",
"quantization": {
"method": "jang-affine-discrete-ternary-lossless-repack+ternary-packed-26b-storage",
"profile": "JANG_AFFINE_TERNARY_PACKED",
"bits": 2,
"block_size": 128,
"group_size": 128,
"mode": "affine",
"quantization_scheme": "asymmetric",
"quantization_backend": "prism-ternary-qat+mlx-native-affine",
"bit_widths_used": [
2,
6
],
"effective_bits_per_parameter": 1.9076,
"tensor_quantization_manifest_schema": 2,
"tensor_quantization_manifest_count": 485,
"tensor_quantization_manifest": {
"language_model.lm_head": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.lm_head.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.lm_head.signs"
}
},
"language_model.model.embed_tokens": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.embed_tokens.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "inverse",
"signs_tensor": "language_model.model.embed_tokens.signs"
}
},
"language_model.model.layers.0.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.0.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.0.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.0.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.0.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.0.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.0.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.0.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.0.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.0.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.0.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.0.mlp.down_proj.signs"
}
},
"language_model.model.layers.0.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.0.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.0.mlp.gate_proj.signs"
}
},
"language_model.model.layers.0.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.0.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.0.mlp.up_proj.signs"
}
},
"language_model.model.layers.1.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.1.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.1.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.1.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.1.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.1.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.1.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.1.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.1.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.1.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.1.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.1.mlp.down_proj.signs"
}
},
"language_model.model.layers.1.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.1.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.1.mlp.gate_proj.signs"
}
},
"language_model.model.layers.1.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.1.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.1.mlp.up_proj.signs"
}
},
"language_model.model.layers.10.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.10.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.10.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.10.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.10.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.10.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.10.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.10.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.10.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.10.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.10.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.10.mlp.down_proj.signs"
}
},
"language_model.model.layers.10.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.10.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.10.mlp.gate_proj.signs"
}
},
"language_model.model.layers.10.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.10.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.10.mlp.up_proj.signs"
}
},
"language_model.model.layers.11.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.mlp.down_proj.signs"
}
},
"language_model.model.layers.11.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.mlp.gate_proj.signs"
}
},
"language_model.model.layers.11.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.mlp.up_proj.signs"
}
},
"language_model.model.layers.11.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.self_attn.k_proj.signs"
}
},
"language_model.model.layers.11.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.self_attn.o_proj.signs"
}
},
"language_model.model.layers.11.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.self_attn.q_proj.signs"
}
},
"language_model.model.layers.11.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.11.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.11.self_attn.v_proj.signs"
}
},
"language_model.model.layers.12.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.12.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.12.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.12.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.12.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.12.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.12.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.12.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.12.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.12.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.12.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.12.mlp.down_proj.signs"
}
},
"language_model.model.layers.12.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.12.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.12.mlp.gate_proj.signs"
}
},
"language_model.model.layers.12.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.12.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.12.mlp.up_proj.signs"
}
},
"language_model.model.layers.13.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.13.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.13.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.13.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.13.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.13.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.13.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.13.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.13.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.13.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.13.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.13.mlp.down_proj.signs"
}
},
"language_model.model.layers.13.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.13.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.13.mlp.gate_proj.signs"
}
},
"language_model.model.layers.13.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.13.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.13.mlp.up_proj.signs"
}
},
"language_model.model.layers.14.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.14.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.14.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.14.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.14.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.14.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.14.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.14.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.14.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.14.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.14.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.14.mlp.down_proj.signs"
}
},
"language_model.model.layers.14.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.14.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.14.mlp.gate_proj.signs"
}
},
"language_model.model.layers.14.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.14.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.14.mlp.up_proj.signs"
}
},
"language_model.model.layers.15.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.mlp.down_proj.signs"
}
},
"language_model.model.layers.15.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.mlp.gate_proj.signs"
}
},
"language_model.model.layers.15.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.mlp.up_proj.signs"
}
},
"language_model.model.layers.15.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.self_attn.k_proj.signs"
}
},
"language_model.model.layers.15.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.self_attn.o_proj.signs"
}
},
"language_model.model.layers.15.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.self_attn.q_proj.signs"
}
},
"language_model.model.layers.15.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.15.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.15.self_attn.v_proj.signs"
}
},
"language_model.model.layers.16.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.16.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.16.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.16.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.16.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.16.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.16.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.16.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.16.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.16.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.16.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.16.mlp.down_proj.signs"
}
},
"language_model.model.layers.16.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.16.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.16.mlp.gate_proj.signs"
}
},
"language_model.model.layers.16.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.16.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.16.mlp.up_proj.signs"
}
},
"language_model.model.layers.17.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.17.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.17.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.17.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.17.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.17.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.17.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.17.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.17.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.17.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.17.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.17.mlp.down_proj.signs"
}
},
"language_model.model.layers.17.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.17.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.17.mlp.gate_proj.signs"
}
},
"language_model.model.layers.17.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.17.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.17.mlp.up_proj.signs"
}
},
"language_model.model.layers.18.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.18.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.18.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.18.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.18.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.18.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.18.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.18.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.18.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.18.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.18.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.18.mlp.down_proj.signs"
}
},
"language_model.model.layers.18.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.18.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.18.mlp.gate_proj.signs"
}
},
"language_model.model.layers.18.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.18.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.18.mlp.up_proj.signs"
}
},
"language_model.model.layers.19.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.mlp.down_proj.signs"
}
},
"language_model.model.layers.19.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.mlp.gate_proj.signs"
}
},
"language_model.model.layers.19.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.mlp.up_proj.signs"
}
},
"language_model.model.layers.19.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.self_attn.k_proj.signs"
}
},
"language_model.model.layers.19.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.self_attn.o_proj.signs"
}
},
"language_model.model.layers.19.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.self_attn.q_proj.signs"
}
},
"language_model.model.layers.19.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.19.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.19.self_attn.v_proj.signs"
}
},
"language_model.model.layers.2.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.2.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.2.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.2.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.2.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.2.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.2.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.2.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.2.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.2.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.2.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.2.mlp.down_proj.signs"
}
},
"language_model.model.layers.2.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.2.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.2.mlp.gate_proj.signs"
}
},
"language_model.model.layers.2.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.2.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.2.mlp.up_proj.signs"
}
},
"language_model.model.layers.20.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.20.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.20.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.20.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.20.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.20.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.20.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.20.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.20.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.20.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.20.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.20.mlp.down_proj.signs"
}
},
"language_model.model.layers.20.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.20.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.20.mlp.gate_proj.signs"
}
},
"language_model.model.layers.20.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.20.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.20.mlp.up_proj.signs"
}
},
"language_model.model.layers.21.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.21.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.21.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.21.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.21.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.21.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.21.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.21.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.21.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.21.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.21.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.21.mlp.down_proj.signs"
}
},
"language_model.model.layers.21.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.21.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.21.mlp.gate_proj.signs"
}
},
"language_model.model.layers.21.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.21.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.21.mlp.up_proj.signs"
}
},
"language_model.model.layers.22.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.22.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.22.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.22.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.22.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.22.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.22.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.22.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.22.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.22.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.22.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.22.mlp.down_proj.signs"
}
},
"language_model.model.layers.22.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.22.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.22.mlp.gate_proj.signs"
}
},
"language_model.model.layers.22.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.22.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.22.mlp.up_proj.signs"
}
},
"language_model.model.layers.23.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.mlp.down_proj.signs"
}
},
"language_model.model.layers.23.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.mlp.gate_proj.signs"
}
},
"language_model.model.layers.23.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.mlp.up_proj.signs"
}
},
"language_model.model.layers.23.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.self_attn.k_proj.signs"
}
},
"language_model.model.layers.23.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.self_attn.o_proj.signs"
}
},
"language_model.model.layers.23.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.self_attn.q_proj.signs"
}
},
"language_model.model.layers.23.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.23.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.23.self_attn.v_proj.signs"
}
},
"language_model.model.layers.24.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.24.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.24.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.24.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.24.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.24.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.24.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.24.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.24.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.24.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.24.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.24.mlp.down_proj.signs"
}
},
"language_model.model.layers.24.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.24.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.24.mlp.gate_proj.signs"
}
},
"language_model.model.layers.24.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.24.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.24.mlp.up_proj.signs"
}
},
"language_model.model.layers.25.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.25.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.25.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.25.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.25.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.25.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.25.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.25.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.25.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.25.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.25.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.25.mlp.down_proj.signs"
}
},
"language_model.model.layers.25.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.25.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.25.mlp.gate_proj.signs"
}
},
"language_model.model.layers.25.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.25.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.25.mlp.up_proj.signs"
}
},
"language_model.model.layers.26.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.26.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.26.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.26.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.26.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.26.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.26.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.26.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.26.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.26.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.26.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.26.mlp.down_proj.signs"
}
},
"language_model.model.layers.26.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.26.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.26.mlp.gate_proj.signs"
}
},
"language_model.model.layers.26.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.26.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.26.mlp.up_proj.signs"
}
},
"language_model.model.layers.27.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.mlp.down_proj.signs"
}
},
"language_model.model.layers.27.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.mlp.gate_proj.signs"
}
},
"language_model.model.layers.27.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.mlp.up_proj.signs"
}
},
"language_model.model.layers.27.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.self_attn.k_proj.signs"
}
},
"language_model.model.layers.27.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.self_attn.o_proj.signs"
}
},
"language_model.model.layers.27.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.self_attn.q_proj.signs"
}
},
"language_model.model.layers.27.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.27.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.27.self_attn.v_proj.signs"
}
},
"language_model.model.layers.28.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.28.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.28.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.28.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.28.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.28.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.28.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.28.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.28.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.28.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.28.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.28.mlp.down_proj.signs"
}
},
"language_model.model.layers.28.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.28.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.28.mlp.gate_proj.signs"
}
},
"language_model.model.layers.28.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.28.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.28.mlp.up_proj.signs"
}
},
"language_model.model.layers.29.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.29.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.29.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.29.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.29.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.29.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.29.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.29.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.29.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.29.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.29.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.29.mlp.down_proj.signs"
}
},
"language_model.model.layers.29.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.29.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.29.mlp.gate_proj.signs"
}
},
"language_model.model.layers.29.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.29.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.29.mlp.up_proj.signs"
}
},
"language_model.model.layers.3.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.mlp.down_proj.signs"
}
},
"language_model.model.layers.3.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.mlp.gate_proj.signs"
}
},
"language_model.model.layers.3.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.mlp.up_proj.signs"
}
},
"language_model.model.layers.3.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.self_attn.k_proj.signs"
}
},
"language_model.model.layers.3.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.self_attn.o_proj.signs"
}
},
"language_model.model.layers.3.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.self_attn.q_proj.signs"
}
},
"language_model.model.layers.3.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.3.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.3.self_attn.v_proj.signs"
}
},
"language_model.model.layers.30.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.30.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.30.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.30.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.30.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.30.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.30.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.30.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.30.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.30.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.30.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.30.mlp.down_proj.signs"
}
},
"language_model.model.layers.30.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.30.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.30.mlp.gate_proj.signs"
}
},
"language_model.model.layers.30.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.30.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.30.mlp.up_proj.signs"
}
},
"language_model.model.layers.31.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.mlp.down_proj.signs"
}
},
"language_model.model.layers.31.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.mlp.gate_proj.signs"
}
},
"language_model.model.layers.31.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.mlp.up_proj.signs"
}
},
"language_model.model.layers.31.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.self_attn.k_proj.signs"
}
},
"language_model.model.layers.31.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.self_attn.o_proj.signs"
}
},
"language_model.model.layers.31.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.self_attn.q_proj.signs"
}
},
"language_model.model.layers.31.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.31.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.31.self_attn.v_proj.signs"
}
},
"language_model.model.layers.32.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.32.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.32.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.32.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.32.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.32.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.32.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.32.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.32.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.32.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.32.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.32.mlp.down_proj.signs"
}
},
"language_model.model.layers.32.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.32.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.32.mlp.gate_proj.signs"
}
},
"language_model.model.layers.32.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.32.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.32.mlp.up_proj.signs"
}
},
"language_model.model.layers.33.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.33.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.33.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.33.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.33.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.33.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.33.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.33.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.33.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.33.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.33.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.33.mlp.down_proj.signs"
}
},
"language_model.model.layers.33.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.33.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.33.mlp.gate_proj.signs"
}
},
"language_model.model.layers.33.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.33.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.33.mlp.up_proj.signs"
}
},
"language_model.model.layers.34.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.34.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.34.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.34.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.34.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.34.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.34.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.34.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.34.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.34.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.34.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.34.mlp.down_proj.signs"
}
},
"language_model.model.layers.34.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.34.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.34.mlp.gate_proj.signs"
}
},
"language_model.model.layers.34.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.34.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.34.mlp.up_proj.signs"
}
},
"language_model.model.layers.35.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.mlp.down_proj.signs"
}
},
"language_model.model.layers.35.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.mlp.gate_proj.signs"
}
},
"language_model.model.layers.35.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.mlp.up_proj.signs"
}
},
"language_model.model.layers.35.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.self_attn.k_proj.signs"
}
},
"language_model.model.layers.35.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.self_attn.o_proj.signs"
}
},
"language_model.model.layers.35.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.self_attn.q_proj.signs"
}
},
"language_model.model.layers.35.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.35.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.35.self_attn.v_proj.signs"
}
},
"language_model.model.layers.36.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.36.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.36.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.36.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.36.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.36.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.36.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.36.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.36.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.36.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.36.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.36.mlp.down_proj.signs"
}
},
"language_model.model.layers.36.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.36.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.36.mlp.gate_proj.signs"
}
},
"language_model.model.layers.36.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.36.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.36.mlp.up_proj.signs"
}
},
"language_model.model.layers.37.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.37.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.37.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.37.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.37.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.37.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.37.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.37.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.37.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.37.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.37.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.37.mlp.down_proj.signs"
}
},
"language_model.model.layers.37.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.37.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.37.mlp.gate_proj.signs"
}
},
"language_model.model.layers.37.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.37.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.37.mlp.up_proj.signs"
}
},
"language_model.model.layers.38.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.38.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.38.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.38.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.38.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.38.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.38.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.38.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.38.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.38.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.38.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.38.mlp.down_proj.signs"
}
},
"language_model.model.layers.38.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.38.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.38.mlp.gate_proj.signs"
}
},
"language_model.model.layers.38.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.38.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.38.mlp.up_proj.signs"
}
},
"language_model.model.layers.39.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.mlp.down_proj.signs"
}
},
"language_model.model.layers.39.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.mlp.gate_proj.signs"
}
},
"language_model.model.layers.39.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.mlp.up_proj.signs"
}
},
"language_model.model.layers.39.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.self_attn.k_proj.signs"
}
},
"language_model.model.layers.39.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.self_attn.o_proj.signs"
}
},
"language_model.model.layers.39.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.self_attn.q_proj.signs"
}
},
"language_model.model.layers.39.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.39.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.39.self_attn.v_proj.signs"
}
},
"language_model.model.layers.4.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.4.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.4.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.4.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.4.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.4.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.4.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.4.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.4.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.4.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.4.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.4.mlp.down_proj.signs"
}
},
"language_model.model.layers.4.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.4.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.4.mlp.gate_proj.signs"
}
},
"language_model.model.layers.4.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.4.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.4.mlp.up_proj.signs"
}
},
"language_model.model.layers.40.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.40.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.40.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.40.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.40.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.40.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.40.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.40.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.40.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.40.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.40.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.40.mlp.down_proj.signs"
}
},
"language_model.model.layers.40.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.40.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.40.mlp.gate_proj.signs"
}
},
"language_model.model.layers.40.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.40.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.40.mlp.up_proj.signs"
}
},
"language_model.model.layers.41.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.41.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.41.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.41.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.41.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.41.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.41.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.41.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.41.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.41.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.41.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.41.mlp.down_proj.signs"
}
},
"language_model.model.layers.41.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.41.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.41.mlp.gate_proj.signs"
}
},
"language_model.model.layers.41.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.41.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.41.mlp.up_proj.signs"
}
},
"language_model.model.layers.42.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.42.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.42.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.42.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.42.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.42.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.42.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.42.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.42.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.42.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.42.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.42.mlp.down_proj.signs"
}
},
"language_model.model.layers.42.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.42.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.42.mlp.gate_proj.signs"
}
},
"language_model.model.layers.42.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.42.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.42.mlp.up_proj.signs"
}
},
"language_model.model.layers.43.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.mlp.down_proj.signs"
}
},
"language_model.model.layers.43.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.mlp.gate_proj.signs"
}
},
"language_model.model.layers.43.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.mlp.up_proj.signs"
}
},
"language_model.model.layers.43.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.self_attn.k_proj.signs"
}
},
"language_model.model.layers.43.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.self_attn.o_proj.signs"
}
},
"language_model.model.layers.43.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.self_attn.q_proj.signs"
}
},
"language_model.model.layers.43.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.43.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.43.self_attn.v_proj.signs"
}
},
"language_model.model.layers.44.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.44.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.44.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.44.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.44.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.44.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.44.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.44.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.44.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.44.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.44.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.44.mlp.down_proj.signs"
}
},
"language_model.model.layers.44.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.44.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.44.mlp.gate_proj.signs"
}
},
"language_model.model.layers.44.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.44.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.44.mlp.up_proj.signs"
}
},
"language_model.model.layers.45.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.45.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.45.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.45.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.45.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.45.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.45.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.45.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.45.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.45.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.45.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.45.mlp.down_proj.signs"
}
},
"language_model.model.layers.45.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.45.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.45.mlp.gate_proj.signs"
}
},
"language_model.model.layers.45.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.45.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.45.mlp.up_proj.signs"
}
},
"language_model.model.layers.46.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.46.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.46.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.46.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.46.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.46.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.46.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.46.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.46.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.46.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.46.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.46.mlp.down_proj.signs"
}
},
"language_model.model.layers.46.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.46.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.46.mlp.gate_proj.signs"
}
},
"language_model.model.layers.46.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.46.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.46.mlp.up_proj.signs"
}
},
"language_model.model.layers.47.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.mlp.down_proj.signs"
}
},
"language_model.model.layers.47.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.mlp.gate_proj.signs"
}
},
"language_model.model.layers.47.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.mlp.up_proj.signs"
}
},
"language_model.model.layers.47.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.self_attn.k_proj.signs"
}
},
"language_model.model.layers.47.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.self_attn.o_proj.signs"
}
},
"language_model.model.layers.47.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.self_attn.q_proj.signs"
}
},
"language_model.model.layers.47.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.47.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.47.self_attn.v_proj.signs"
}
},
"language_model.model.layers.48.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.48.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.48.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.48.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.48.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.48.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.48.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.48.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.48.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.48.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.48.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.48.mlp.down_proj.signs"
}
},
"language_model.model.layers.48.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.48.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.48.mlp.gate_proj.signs"
}
},
"language_model.model.layers.48.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.48.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.48.mlp.up_proj.signs"
}
},
"language_model.model.layers.49.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.49.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.49.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.49.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.49.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.49.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.49.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.49.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.49.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.49.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.49.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.49.mlp.down_proj.signs"
}
},
"language_model.model.layers.49.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.49.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.49.mlp.gate_proj.signs"
}
},
"language_model.model.layers.49.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.49.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.49.mlp.up_proj.signs"
}
},
"language_model.model.layers.5.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.5.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.5.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.5.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.5.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.5.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.5.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.5.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.5.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.5.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.5.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.5.mlp.down_proj.signs"
}
},
"language_model.model.layers.5.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.5.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.5.mlp.gate_proj.signs"
}
},
"language_model.model.layers.5.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.5.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.5.mlp.up_proj.signs"
}
},
"language_model.model.layers.50.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.50.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.50.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.50.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.50.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.50.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.50.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.50.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.50.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.50.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.50.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.50.mlp.down_proj.signs"
}
},
"language_model.model.layers.50.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.50.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.50.mlp.gate_proj.signs"
}
},
"language_model.model.layers.50.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.50.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.50.mlp.up_proj.signs"
}
},
"language_model.model.layers.51.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.mlp.down_proj.signs"
}
},
"language_model.model.layers.51.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.mlp.gate_proj.signs"
}
},
"language_model.model.layers.51.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.mlp.up_proj.signs"
}
},
"language_model.model.layers.51.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.self_attn.k_proj.signs"
}
},
"language_model.model.layers.51.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.self_attn.o_proj.signs"
}
},
"language_model.model.layers.51.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.self_attn.q_proj.signs"
}
},
"language_model.model.layers.51.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.51.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.51.self_attn.v_proj.signs"
}
},
"language_model.model.layers.52.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.52.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.52.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.52.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.52.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.52.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.52.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.52.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.52.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.52.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.52.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.52.mlp.down_proj.signs"
}
},
"language_model.model.layers.52.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.52.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.52.mlp.gate_proj.signs"
}
},
"language_model.model.layers.52.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.52.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.52.mlp.up_proj.signs"
}
},
"language_model.model.layers.53.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.53.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.53.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.53.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.53.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.53.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.53.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.53.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.53.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.53.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.53.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.53.mlp.down_proj.signs"
}
},
"language_model.model.layers.53.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.53.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.53.mlp.gate_proj.signs"
}
},
"language_model.model.layers.53.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.53.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.53.mlp.up_proj.signs"
}
},
"language_model.model.layers.54.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.54.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.54.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.54.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.54.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.54.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.54.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.54.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.54.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.54.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.54.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.54.mlp.down_proj.signs"
}
},
"language_model.model.layers.54.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.54.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.54.mlp.gate_proj.signs"
}
},
"language_model.model.layers.54.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.54.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.54.mlp.up_proj.signs"
}
},
"language_model.model.layers.55.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.mlp.down_proj.signs"
}
},
"language_model.model.layers.55.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.mlp.gate_proj.signs"
}
},
"language_model.model.layers.55.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.mlp.up_proj.signs"
}
},
"language_model.model.layers.55.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.self_attn.k_proj.signs"
}
},
"language_model.model.layers.55.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.self_attn.o_proj.signs"
}
},
"language_model.model.layers.55.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.self_attn.q_proj.signs"
}
},
"language_model.model.layers.55.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.55.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.55.self_attn.v_proj.signs"
}
},
"language_model.model.layers.56.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.56.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.56.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.56.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.56.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.56.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.56.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.56.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.56.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.56.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.56.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.56.mlp.down_proj.signs"
}
},
"language_model.model.layers.56.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.56.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.56.mlp.gate_proj.signs"
}
},
"language_model.model.layers.56.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.56.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.56.mlp.up_proj.signs"
}
},
"language_model.model.layers.57.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.57.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.57.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.57.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.57.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.57.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.57.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.57.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.57.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.57.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.57.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.57.mlp.down_proj.signs"
}
},
"language_model.model.layers.57.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.57.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.57.mlp.gate_proj.signs"
}
},
"language_model.model.layers.57.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.57.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.57.mlp.up_proj.signs"
}
},
"language_model.model.layers.58.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.58.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.58.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.58.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.58.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.58.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.58.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.58.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.58.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.58.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.58.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.58.mlp.down_proj.signs"
}
},
"language_model.model.layers.58.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.58.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.58.mlp.gate_proj.signs"
}
},
"language_model.model.layers.58.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.58.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.58.mlp.up_proj.signs"
}
},
"language_model.model.layers.59.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.mlp.down_proj.signs"
}
},
"language_model.model.layers.59.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.mlp.gate_proj.signs"
}
},
"language_model.model.layers.59.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.mlp.up_proj.signs"
}
},
"language_model.model.layers.59.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.self_attn.k_proj.signs"
}
},
"language_model.model.layers.59.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.self_attn.o_proj.signs"
}
},
"language_model.model.layers.59.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.self_attn.q_proj.signs"
}
},
"language_model.model.layers.59.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.59.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.59.self_attn.v_proj.signs"
}
},
"language_model.model.layers.6.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.6.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.6.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.6.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.6.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.6.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.6.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.6.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.6.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.6.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.6.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.6.mlp.down_proj.signs"
}
},
"language_model.model.layers.6.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.6.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.6.mlp.gate_proj.signs"
}
},
"language_model.model.layers.6.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.6.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.6.mlp.up_proj.signs"
}
},
"language_model.model.layers.60.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.60.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.60.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.60.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.60.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.60.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.60.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.60.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.60.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.60.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.60.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.60.mlp.down_proj.signs"
}
},
"language_model.model.layers.60.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.60.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.60.mlp.gate_proj.signs"
}
},
"language_model.model.layers.60.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.60.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.60.mlp.up_proj.signs"
}
},
"language_model.model.layers.61.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.61.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.61.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.61.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.61.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.61.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.61.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.61.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.61.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.61.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.61.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.61.mlp.down_proj.signs"
}
},
"language_model.model.layers.61.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.61.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.61.mlp.gate_proj.signs"
}
},
"language_model.model.layers.61.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.61.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.61.mlp.up_proj.signs"
}
},
"language_model.model.layers.62.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.62.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.62.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.62.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.62.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.62.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.62.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.62.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.62.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.62.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.62.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.62.mlp.down_proj.signs"
}
},
"language_model.model.layers.62.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.62.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.62.mlp.gate_proj.signs"
}
},
"language_model.model.layers.62.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.62.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.62.mlp.up_proj.signs"
}
},
"language_model.model.layers.63.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.mlp.down_proj.signs"
}
},
"language_model.model.layers.63.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.mlp.gate_proj.signs"
}
},
"language_model.model.layers.63.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.mlp.up_proj.signs"
}
},
"language_model.model.layers.63.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.self_attn.k_proj.signs"
}
},
"language_model.model.layers.63.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.self_attn.o_proj.signs"
}
},
"language_model.model.layers.63.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.self_attn.q_proj.signs"
}
},
"language_model.model.layers.63.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.63.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.63.self_attn.v_proj.signs"
}
},
"language_model.model.layers.7.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.mlp.down_proj.signs"
}
},
"language_model.model.layers.7.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.mlp.gate_proj.signs"
}
},
"language_model.model.layers.7.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.mlp.up_proj.signs"
}
},
"language_model.model.layers.7.self_attn.k_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.self_attn.k_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.self_attn.k_proj.signs"
}
},
"language_model.model.layers.7.self_attn.o_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.self_attn.o_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.self_attn.o_proj.signs"
}
},
"language_model.model.layers.7.self_attn.q_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.self_attn.q_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.self_attn.q_proj.signs"
}
},
"language_model.model.layers.7.self_attn.v_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.7.self_attn.v_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.7.self_attn.v_proj.signs"
}
},
"language_model.model.layers.8.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.8.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.8.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.8.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.8.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.8.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.8.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.8.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.8.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.8.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.8.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.8.mlp.down_proj.signs"
}
},
"language_model.model.layers.8.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.8.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.8.mlp.gate_proj.signs"
}
},
"language_model.model.layers.8.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.8.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.8.mlp.up_proj.signs"
}
},
"language_model.model.layers.9.linear_attn.in_proj_qkv": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.9.linear_attn.in_proj_qkv.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.9.linear_attn.in_proj_qkv.signs"
}
},
"language_model.model.layers.9.linear_attn.in_proj_z": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.9.linear_attn.in_proj_z.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.9.linear_attn.in_proj_z.signs"
}
},
"language_model.model.layers.9.linear_attn.out_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.9.linear_attn.out_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.9.linear_attn.out_proj.signs"
}
},
"language_model.model.layers.9.mlp.down_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.9.mlp.down_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.9.mlp.down_proj.signs"
}
},
"language_model.model.layers.9.mlp.gate_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.9.mlp.gate_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.9.mlp.gate_proj.signs"
}
},
"language_model.model.layers.9.mlp.up_proj": {
"bits": 2,
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load",
"group_size": 128,
"mode": "affine",
"source_tensor": "language_model.model.layers.9.mlp.up_proj.weight",
"discrete_levels": "ternary",
"discrete_levels_exact": true,
"lossless_repack": true,
"sidecar_dtype": "float16",
"hadamard": {
"block_size": 1024,
"direction": "forward",
"signs_tensor": "language_model.model.layers.9.mlp.up_proj.signs"
}
},
"vision_tower.blocks.0.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.0.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.03114671885613714
},
"vision_tower.blocks.0.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.0.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.0487284327605782
},
"vision_tower.blocks.0.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.0.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.033788636898414395
},
"vision_tower.blocks.1.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.1.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02980344647171637
},
"vision_tower.blocks.1.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.1.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.032480140914934494
},
"vision_tower.blocks.1.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.1.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.03178094575174044
},
"vision_tower.blocks.10.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.10.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026820783474042126
},
"vision_tower.blocks.10.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.10.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026998819519493993
},
"vision_tower.blocks.10.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.10.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026438517061131678
},
"vision_tower.blocks.11.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.11.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026185750542824886
},
"vision_tower.blocks.11.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.11.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02689954865214691
},
"vision_tower.blocks.11.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.11.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02631248273082319
},
"vision_tower.blocks.12.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.12.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026333623669749968
},
"vision_tower.blocks.12.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.12.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02680343750980103
},
"vision_tower.blocks.12.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.12.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02626799103183913
},
"vision_tower.blocks.13.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.13.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026153772089506755
},
"vision_tower.blocks.13.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.13.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026434027094361934
},
"vision_tower.blocks.13.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.13.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026251108613823324
},
"vision_tower.blocks.14.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.14.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026055507552693227
},
"vision_tower.blocks.14.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.14.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026453777577897054
},
"vision_tower.blocks.14.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.14.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02635079293446125
},
"vision_tower.blocks.15.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.15.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02595919801654032
},
"vision_tower.blocks.15.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.15.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02626547619045524
},
"vision_tower.blocks.15.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.15.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02609709633686056
},
"vision_tower.blocks.16.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.16.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.025974845182214643
},
"vision_tower.blocks.16.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.16.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026260896275524796
},
"vision_tower.blocks.16.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.16.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02650049096996159
},
"vision_tower.blocks.17.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.17.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.025891218492353665
},
"vision_tower.blocks.17.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.17.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026208745900798587
},
"vision_tower.blocks.17.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.17.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026795070907207393
},
"vision_tower.blocks.18.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.18.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.0259538797980769
},
"vision_tower.blocks.18.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.18.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026178578285044815
},
"vision_tower.blocks.18.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.18.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02683145098234242
},
"vision_tower.blocks.19.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.19.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02586491260979267
},
"vision_tower.blocks.19.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.19.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02617873507213997
},
"vision_tower.blocks.19.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.19.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027257697755729754
},
"vision_tower.blocks.2.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.2.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.028295275640551325
},
"vision_tower.blocks.2.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.2.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02934867177751939
},
"vision_tower.blocks.2.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.2.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.029143837846171142
},
"vision_tower.blocks.20.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.20.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.025928789813477227
},
"vision_tower.blocks.20.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.20.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02621052058388975
},
"vision_tower.blocks.20.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.20.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02768317267560894
},
"vision_tower.blocks.21.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.21.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02597828961826833
},
"vision_tower.blocks.21.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.21.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026338514899102675
},
"vision_tower.blocks.21.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.21.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027944574991906976
},
"vision_tower.blocks.22.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.22.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026170884279043058
},
"vision_tower.blocks.22.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.22.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02639189096897599
},
"vision_tower.blocks.22.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.22.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.028006104412855167
},
"vision_tower.blocks.23.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.23.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02686725732846684
},
"vision_tower.blocks.23.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.23.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02660456080651205
},
"vision_tower.blocks.23.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.23.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02797980650899829
},
"vision_tower.blocks.24.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.24.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02602861346872952
},
"vision_tower.blocks.24.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.24.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02648298324928136
},
"vision_tower.blocks.24.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.24.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027885463171170695
},
"vision_tower.blocks.25.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.25.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026437849557134407
},
"vision_tower.blocks.25.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.25.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026586951697741668
},
"vision_tower.blocks.25.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.25.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027524776901542404
},
"vision_tower.blocks.26.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.26.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.029074117040414477
},
"vision_tower.blocks.26.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.26.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026593394962008653
},
"vision_tower.blocks.26.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.26.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026766419440602488
},
"vision_tower.blocks.3.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.3.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026748051244855697
},
"vision_tower.blocks.3.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.3.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.028464130663524545
},
"vision_tower.blocks.3.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.3.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027517339159885915
},
"vision_tower.blocks.4.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.4.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02693300194775943
},
"vision_tower.blocks.4.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.4.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.028091346675528494
},
"vision_tower.blocks.4.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.4.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02759703199055213
},
"vision_tower.blocks.5.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.5.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026579687105911656
},
"vision_tower.blocks.5.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.5.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027596807262290267
},
"vision_tower.blocks.5.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.5.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02721476903189207
},
"vision_tower.blocks.6.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.6.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026263941350228213
},
"vision_tower.blocks.6.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.6.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027521537916453825
},
"vision_tower.blocks.6.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.6.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02701156427800195
},
"vision_tower.blocks.7.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.7.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.0263431292589065
},
"vision_tower.blocks.7.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.7.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027386463354745046
},
"vision_tower.blocks.7.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.7.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026949626009427817
},
"vision_tower.blocks.8.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.8.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026436758931145107
},
"vision_tower.blocks.8.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.8.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.027462590637701314
},
"vision_tower.blocks.8.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.8.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026798403689806218
},
"vision_tower.blocks.9.attn.proj": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.9.attn.proj.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.026128159544739384
},
"vision_tower.blocks.9.attn.qkv": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.9.attn.qkv.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.0268437156643466
},
"vision_tower.blocks.9.mlp.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.blocks.9.mlp.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02626577295136895
},
"vision_tower.merger.linear_fc1": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.merger.linear_fc1.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.02613966335614916
},
"vision_tower.merger.linear_fc2": {
"bits": 6,
"storage_bits": 6,
"group_size": 128,
"mode": "affine",
"source_tensor": "vision_tower.merger.linear_fc2.weight",
"method": "native-affine-rtn",
"lossless_source_reconstruction": false,
"source_rel_l1": 0.0258531285573422
}
},
"passthrough_tensor_count": 699,
"passthrough_parameter_count": 164943088,
"calibration": {
"awq": "not applicable: language weights are exact QAT ternary from Prism; no full-precision source exists",
"imatrix": "not applicable: same reason; F16 GGUF is the identical dequantized ternary",
"gptq": "not applicable",
"vision_tower": "plain round-to-nearest native affine 6-bit/g128 (no calibration)"
},
"ternary_packed_runtime_expansion": {
"storage": "ternary_packed_26b",
"runtime_bits": 2,
"group_size": 128,
"lossless": true,
"scales_unchanged": true,
"biases": "materialized as -scales at load",
"disk_bits_per_weight_incl_scale": 1.75
},
"language_model": {
"modules": 402,
"storage": "uint8 base-3 trits (26 B per 128) + float16 scale=s; float32 signs; bias=-s materialized at load",
"lossless_repack_of": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit"
},
"vision_tower": {
"modules": 83,
"bits": 6,
"group_size": 128,
"float16_passthrough": "blocks.N.mlp.linear_fc2 (in=4304), pos_embed, patch_embed, norms, biases"
}
},
"hadamard": {
"contract": "prism.hadamard.v1",
"sidecar": "hadamard.json",
"block_size": 1024,
"transform": "normalized-sylvester-walsh-hadamard",
"axis": "input-last-dimension",
"sign_mode": "explicit",
"signs_dtype": "float32",
"signs_tensor_suffix": "signs",
"compute_dtype": "float32",
"forward_modules": [
"language_model.lm_head",
"language_model.model.layers.0.linear_attn.in_proj_qkv",
"language_model.model.layers.0.linear_attn.in_proj_z",
"language_model.model.layers.0.linear_attn.out_proj",
"language_model.model.layers.0.mlp.down_proj",
"language_model.model.layers.0.mlp.gate_proj",
"language_model.model.layers.0.mlp.up_proj",
"language_model.model.layers.1.linear_attn.in_proj_qkv",
"language_model.model.layers.1.linear_attn.in_proj_z",
"language_model.model.layers.1.linear_attn.out_proj",
"language_model.model.layers.1.mlp.down_proj",
"language_model.model.layers.1.mlp.gate_proj",
"language_model.model.layers.1.mlp.up_proj",
"language_model.model.layers.10.linear_attn.in_proj_qkv",
"language_model.model.layers.10.linear_attn.in_proj_z",
"language_model.model.layers.10.linear_attn.out_proj",
"language_model.model.layers.10.mlp.down_proj",
"language_model.model.layers.10.mlp.gate_proj",
"language_model.model.layers.10.mlp.up_proj",
"language_model.model.layers.11.mlp.down_proj",
"language_model.model.layers.11.mlp.gate_proj",
"language_model.model.layers.11.mlp.up_proj",
"language_model.model.layers.11.self_attn.k_proj",
"language_model.model.layers.11.self_attn.o_proj",
"language_model.model.layers.11.self_attn.q_proj",
"language_model.model.layers.11.self_attn.v_proj",
"language_model.model.layers.12.linear_attn.in_proj_qkv",
"language_model.model.layers.12.linear_attn.in_proj_z",
"language_model.model.layers.12.linear_attn.out_proj",
"language_model.model.layers.12.mlp.down_proj",
"language_model.model.layers.12.mlp.gate_proj",
"language_model.model.layers.12.mlp.up_proj",
"language_model.model.layers.13.linear_attn.in_proj_qkv",
"language_model.model.layers.13.linear_attn.in_proj_z",
"language_model.model.layers.13.linear_attn.out_proj",
"language_model.model.layers.13.mlp.down_proj",
"language_model.model.layers.13.mlp.gate_proj",
"language_model.model.layers.13.mlp.up_proj",
"language_model.model.layers.14.linear_attn.in_proj_qkv",
"language_model.model.layers.14.linear_attn.in_proj_z",
"language_model.model.layers.14.linear_attn.out_proj",
"language_model.model.layers.14.mlp.down_proj",
"language_model.model.layers.14.mlp.gate_proj",
"language_model.model.layers.14.mlp.up_proj",
"language_model.model.layers.15.mlp.down_proj",
"language_model.model.layers.15.mlp.gate_proj",
"language_model.model.layers.15.mlp.up_proj",
"language_model.model.layers.15.self_attn.k_proj",
"language_model.model.layers.15.self_attn.o_proj",
"language_model.model.layers.15.self_attn.q_proj",
"language_model.model.layers.15.self_attn.v_proj",
"language_model.model.layers.16.linear_attn.in_proj_qkv",
"language_model.model.layers.16.linear_attn.in_proj_z",
"language_model.model.layers.16.linear_attn.out_proj",
"language_model.model.layers.16.mlp.down_proj",
"language_model.model.layers.16.mlp.gate_proj",
"language_model.model.layers.16.mlp.up_proj",
"language_model.model.layers.17.linear_attn.in_proj_qkv",
"language_model.model.layers.17.linear_attn.in_proj_z",
"language_model.model.layers.17.linear_attn.out_proj",
"language_model.model.layers.17.mlp.down_proj",
"language_model.model.layers.17.mlp.gate_proj",
"language_model.model.layers.17.mlp.up_proj",
"language_model.model.layers.18.linear_attn.in_proj_qkv",
"language_model.model.layers.18.linear_attn.in_proj_z",
"language_model.model.layers.18.linear_attn.out_proj",
"language_model.model.layers.18.mlp.down_proj",
"language_model.model.layers.18.mlp.gate_proj",
"language_model.model.layers.18.mlp.up_proj",
"language_model.model.layers.19.mlp.down_proj",
"language_model.model.layers.19.mlp.gate_proj",
"language_model.model.layers.19.mlp.up_proj",
"language_model.model.layers.19.self_attn.k_proj",
"language_model.model.layers.19.self_attn.o_proj",
"language_model.model.layers.19.self_attn.q_proj",
"language_model.model.layers.19.self_attn.v_proj",
"language_model.model.layers.2.linear_attn.in_proj_qkv",
"language_model.model.layers.2.linear_attn.in_proj_z",
"language_model.model.layers.2.linear_attn.out_proj",
"language_model.model.layers.2.mlp.down_proj",
"language_model.model.layers.2.mlp.gate_proj",
"language_model.model.layers.2.mlp.up_proj",
"language_model.model.layers.20.linear_attn.in_proj_qkv",
"language_model.model.layers.20.linear_attn.in_proj_z",
"language_model.model.layers.20.linear_attn.out_proj",
"language_model.model.layers.20.mlp.down_proj",
"language_model.model.layers.20.mlp.gate_proj",
"language_model.model.layers.20.mlp.up_proj",
"language_model.model.layers.21.linear_attn.in_proj_qkv",
"language_model.model.layers.21.linear_attn.in_proj_z",
"language_model.model.layers.21.linear_attn.out_proj",
"language_model.model.layers.21.mlp.down_proj",
"language_model.model.layers.21.mlp.gate_proj",
"language_model.model.layers.21.mlp.up_proj",
"language_model.model.layers.22.linear_attn.in_proj_qkv",
"language_model.model.layers.22.linear_attn.in_proj_z",
"language_model.model.layers.22.linear_attn.out_proj",
"language_model.model.layers.22.mlp.down_proj",
"language_model.model.layers.22.mlp.gate_proj",
"language_model.model.layers.22.mlp.up_proj",
"language_model.model.layers.23.mlp.down_proj",
"language_model.model.layers.23.mlp.gate_proj",
"language_model.model.layers.23.mlp.up_proj",
"language_model.model.layers.23.self_attn.k_proj",
"language_model.model.layers.23.self_attn.o_proj",
"language_model.model.layers.23.self_attn.q_proj",
"language_model.model.layers.23.self_attn.v_proj",
"language_model.model.layers.24.linear_attn.in_proj_qkv",
"language_model.model.layers.24.linear_attn.in_proj_z",
"language_model.model.layers.24.linear_attn.out_proj",
"language_model.model.layers.24.mlp.down_proj",
"language_model.model.layers.24.mlp.gate_proj",
"language_model.model.layers.24.mlp.up_proj",
"language_model.model.layers.25.linear_attn.in_proj_qkv",
"language_model.model.layers.25.linear_attn.in_proj_z",
"language_model.model.layers.25.linear_attn.out_proj",
"language_model.model.layers.25.mlp.down_proj",
"language_model.model.layers.25.mlp.gate_proj",
"language_model.model.layers.25.mlp.up_proj",
"language_model.model.layers.26.linear_attn.in_proj_qkv",
"language_model.model.layers.26.linear_attn.in_proj_z",
"language_model.model.layers.26.linear_attn.out_proj",
"language_model.model.layers.26.mlp.down_proj",
"language_model.model.layers.26.mlp.gate_proj",
"language_model.model.layers.26.mlp.up_proj",
"language_model.model.layers.27.mlp.down_proj",
"language_model.model.layers.27.mlp.gate_proj",
"language_model.model.layers.27.mlp.up_proj",
"language_model.model.layers.27.self_attn.k_proj",
"language_model.model.layers.27.self_attn.o_proj",
"language_model.model.layers.27.self_attn.q_proj",
"language_model.model.layers.27.self_attn.v_proj",
"language_model.model.layers.28.linear_attn.in_proj_qkv",
"language_model.model.layers.28.linear_attn.in_proj_z",
"language_model.model.layers.28.linear_attn.out_proj",
"language_model.model.layers.28.mlp.down_proj",
"language_model.model.layers.28.mlp.gate_proj",
"language_model.model.layers.28.mlp.up_proj",
"language_model.model.layers.29.linear_attn.in_proj_qkv",
"language_model.model.layers.29.linear_attn.in_proj_z",
"language_model.model.layers.29.linear_attn.out_proj",
"language_model.model.layers.29.mlp.down_proj",
"language_model.model.layers.29.mlp.gate_proj",
"language_model.model.layers.29.mlp.up_proj",
"language_model.model.layers.3.mlp.down_proj",
"language_model.model.layers.3.mlp.gate_proj",
"language_model.model.layers.3.mlp.up_proj",
"language_model.model.layers.3.self_attn.k_proj",
"language_model.model.layers.3.self_attn.o_proj",
"language_model.model.layers.3.self_attn.q_proj",
"language_model.model.layers.3.self_attn.v_proj",
"language_model.model.layers.30.linear_attn.in_proj_qkv",
"language_model.model.layers.30.linear_attn.in_proj_z",
"language_model.model.layers.30.linear_attn.out_proj",
"language_model.model.layers.30.mlp.down_proj",
"language_model.model.layers.30.mlp.gate_proj",
"language_model.model.layers.30.mlp.up_proj",
"language_model.model.layers.31.mlp.down_proj",
"language_model.model.layers.31.mlp.gate_proj",
"language_model.model.layers.31.mlp.up_proj",
"language_model.model.layers.31.self_attn.k_proj",
"language_model.model.layers.31.self_attn.o_proj",
"language_model.model.layers.31.self_attn.q_proj",
"language_model.model.layers.31.self_attn.v_proj",
"language_model.model.layers.32.linear_attn.in_proj_qkv",
"language_model.model.layers.32.linear_attn.in_proj_z",
"language_model.model.layers.32.linear_attn.out_proj",
"language_model.model.layers.32.mlp.down_proj",
"language_model.model.layers.32.mlp.gate_proj",
"language_model.model.layers.32.mlp.up_proj",
"language_model.model.layers.33.linear_attn.in_proj_qkv",
"language_model.model.layers.33.linear_attn.in_proj_z",
"language_model.model.layers.33.linear_attn.out_proj",
"language_model.model.layers.33.mlp.down_proj",
"language_model.model.layers.33.mlp.gate_proj",
"language_model.model.layers.33.mlp.up_proj",
"language_model.model.layers.34.linear_attn.in_proj_qkv",
"language_model.model.layers.34.linear_attn.in_proj_z",
"language_model.model.layers.34.linear_attn.out_proj",
"language_model.model.layers.34.mlp.down_proj",
"language_model.model.layers.34.mlp.gate_proj",
"language_model.model.layers.34.mlp.up_proj",
"language_model.model.layers.35.mlp.down_proj",
"language_model.model.layers.35.mlp.gate_proj",
"language_model.model.layers.35.mlp.up_proj",
"language_model.model.layers.35.self_attn.k_proj",
"language_model.model.layers.35.self_attn.o_proj",
"language_model.model.layers.35.self_attn.q_proj",
"language_model.model.layers.35.self_attn.v_proj",
"language_model.model.layers.36.linear_attn.in_proj_qkv",
"language_model.model.layers.36.linear_attn.in_proj_z",
"language_model.model.layers.36.linear_attn.out_proj",
"language_model.model.layers.36.mlp.down_proj",
"language_model.model.layers.36.mlp.gate_proj",
"language_model.model.layers.36.mlp.up_proj",
"language_model.model.layers.37.linear_attn.in_proj_qkv",
"language_model.model.layers.37.linear_attn.in_proj_z",
"language_model.model.layers.37.linear_attn.out_proj",
"language_model.model.layers.37.mlp.down_proj",
"language_model.model.layers.37.mlp.gate_proj",
"language_model.model.layers.37.mlp.up_proj",
"language_model.model.layers.38.linear_attn.in_proj_qkv",
"language_model.model.layers.38.linear_attn.in_proj_z",
"language_model.model.layers.38.linear_attn.out_proj",
"language_model.model.layers.38.mlp.down_proj",
"language_model.model.layers.38.mlp.gate_proj",
"language_model.model.layers.38.mlp.up_proj",
"language_model.model.layers.39.mlp.down_proj",
"language_model.model.layers.39.mlp.gate_proj",
"language_model.model.layers.39.mlp.up_proj",
"language_model.model.layers.39.self_attn.k_proj",
"language_model.model.layers.39.self_attn.o_proj",
"language_model.model.layers.39.self_attn.q_proj",
"language_model.model.layers.39.self_attn.v_proj",
"language_model.model.layers.4.linear_attn.in_proj_qkv",
"language_model.model.layers.4.linear_attn.in_proj_z",
"language_model.model.layers.4.linear_attn.out_proj",
"language_model.model.layers.4.mlp.down_proj",
"language_model.model.layers.4.mlp.gate_proj",
"language_model.model.layers.4.mlp.up_proj",
"language_model.model.layers.40.linear_attn.in_proj_qkv",
"language_model.model.layers.40.linear_attn.in_proj_z",
"language_model.model.layers.40.linear_attn.out_proj",
"language_model.model.layers.40.mlp.down_proj",
"language_model.model.layers.40.mlp.gate_proj",
"language_model.model.layers.40.mlp.up_proj",
"language_model.model.layers.41.linear_attn.in_proj_qkv",
"language_model.model.layers.41.linear_attn.in_proj_z",
"language_model.model.layers.41.linear_attn.out_proj",
"language_model.model.layers.41.mlp.down_proj",
"language_model.model.layers.41.mlp.gate_proj",
"language_model.model.layers.41.mlp.up_proj",
"language_model.model.layers.42.linear_attn.in_proj_qkv",
"language_model.model.layers.42.linear_attn.in_proj_z",
"language_model.model.layers.42.linear_attn.out_proj",
"language_model.model.layers.42.mlp.down_proj",
"language_model.model.layers.42.mlp.gate_proj",
"language_model.model.layers.42.mlp.up_proj",
"language_model.model.layers.43.mlp.down_proj",
"language_model.model.layers.43.mlp.gate_proj",
"language_model.model.layers.43.mlp.up_proj",
"language_model.model.layers.43.self_attn.k_proj",
"language_model.model.layers.43.self_attn.o_proj",
"language_model.model.layers.43.self_attn.q_proj",
"language_model.model.layers.43.self_attn.v_proj",
"language_model.model.layers.44.linear_attn.in_proj_qkv",
"language_model.model.layers.44.linear_attn.in_proj_z",
"language_model.model.layers.44.linear_attn.out_proj",
"language_model.model.layers.44.mlp.down_proj",
"language_model.model.layers.44.mlp.gate_proj",
"language_model.model.layers.44.mlp.up_proj",
"language_model.model.layers.45.linear_attn.in_proj_qkv",
"language_model.model.layers.45.linear_attn.in_proj_z",
"language_model.model.layers.45.linear_attn.out_proj",
"language_model.model.layers.45.mlp.down_proj",
"language_model.model.layers.45.mlp.gate_proj",
"language_model.model.layers.45.mlp.up_proj",
"language_model.model.layers.46.linear_attn.in_proj_qkv",
"language_model.model.layers.46.linear_attn.in_proj_z",
"language_model.model.layers.46.linear_attn.out_proj",
"language_model.model.layers.46.mlp.down_proj",
"language_model.model.layers.46.mlp.gate_proj",
"language_model.model.layers.46.mlp.up_proj",
"language_model.model.layers.47.mlp.down_proj",
"language_model.model.layers.47.mlp.gate_proj",
"language_model.model.layers.47.mlp.up_proj",
"language_model.model.layers.47.self_attn.k_proj",
"language_model.model.layers.47.self_attn.o_proj",
"language_model.model.layers.47.self_attn.q_proj",
"language_model.model.layers.47.self_attn.v_proj",
"language_model.model.layers.48.linear_attn.in_proj_qkv",
"language_model.model.layers.48.linear_attn.in_proj_z",
"language_model.model.layers.48.linear_attn.out_proj",
"language_model.model.layers.48.mlp.down_proj",
"language_model.model.layers.48.mlp.gate_proj",
"language_model.model.layers.48.mlp.up_proj",
"language_model.model.layers.49.linear_attn.in_proj_qkv",
"language_model.model.layers.49.linear_attn.in_proj_z",
"language_model.model.layers.49.linear_attn.out_proj",
"language_model.model.layers.49.mlp.down_proj",
"language_model.model.layers.49.mlp.gate_proj",
"language_model.model.layers.49.mlp.up_proj",
"language_model.model.layers.5.linear_attn.in_proj_qkv",
"language_model.model.layers.5.linear_attn.in_proj_z",
"language_model.model.layers.5.linear_attn.out_proj",
"language_model.model.layers.5.mlp.down_proj",
"language_model.model.layers.5.mlp.gate_proj",
"language_model.model.layers.5.mlp.up_proj",
"language_model.model.layers.50.linear_attn.in_proj_qkv",
"language_model.model.layers.50.linear_attn.in_proj_z",
"language_model.model.layers.50.linear_attn.out_proj",
"language_model.model.layers.50.mlp.down_proj",
"language_model.model.layers.50.mlp.gate_proj",
"language_model.model.layers.50.mlp.up_proj",
"language_model.model.layers.51.mlp.down_proj",
"language_model.model.layers.51.mlp.gate_proj",
"language_model.model.layers.51.mlp.up_proj",
"language_model.model.layers.51.self_attn.k_proj",
"language_model.model.layers.51.self_attn.o_proj",
"language_model.model.layers.51.self_attn.q_proj",
"language_model.model.layers.51.self_attn.v_proj",
"language_model.model.layers.52.linear_attn.in_proj_qkv",
"language_model.model.layers.52.linear_attn.in_proj_z",
"language_model.model.layers.52.linear_attn.out_proj",
"language_model.model.layers.52.mlp.down_proj",
"language_model.model.layers.52.mlp.gate_proj",
"language_model.model.layers.52.mlp.up_proj",
"language_model.model.layers.53.linear_attn.in_proj_qkv",
"language_model.model.layers.53.linear_attn.in_proj_z",
"language_model.model.layers.53.linear_attn.out_proj",
"language_model.model.layers.53.mlp.down_proj",
"language_model.model.layers.53.mlp.gate_proj",
"language_model.model.layers.53.mlp.up_proj",
"language_model.model.layers.54.linear_attn.in_proj_qkv",
"language_model.model.layers.54.linear_attn.in_proj_z",
"language_model.model.layers.54.linear_attn.out_proj",
"language_model.model.layers.54.mlp.down_proj",
"language_model.model.layers.54.mlp.gate_proj",
"language_model.model.layers.54.mlp.up_proj",
"language_model.model.layers.55.mlp.down_proj",
"language_model.model.layers.55.mlp.gate_proj",
"language_model.model.layers.55.mlp.up_proj",
"language_model.model.layers.55.self_attn.k_proj",
"language_model.model.layers.55.self_attn.o_proj",
"language_model.model.layers.55.self_attn.q_proj",
"language_model.model.layers.55.self_attn.v_proj",
"language_model.model.layers.56.linear_attn.in_proj_qkv",
"language_model.model.layers.56.linear_attn.in_proj_z",
"language_model.model.layers.56.linear_attn.out_proj",
"language_model.model.layers.56.mlp.down_proj",
"language_model.model.layers.56.mlp.gate_proj",
"language_model.model.layers.56.mlp.up_proj",
"language_model.model.layers.57.linear_attn.in_proj_qkv",
"language_model.model.layers.57.linear_attn.in_proj_z",
"language_model.model.layers.57.linear_attn.out_proj",
"language_model.model.layers.57.mlp.down_proj",
"language_model.model.layers.57.mlp.gate_proj",
"language_model.model.layers.57.mlp.up_proj",
"language_model.model.layers.58.linear_attn.in_proj_qkv",
"language_model.model.layers.58.linear_attn.in_proj_z",
"language_model.model.layers.58.linear_attn.out_proj",
"language_model.model.layers.58.mlp.down_proj",
"language_model.model.layers.58.mlp.gate_proj",
"language_model.model.layers.58.mlp.up_proj",
"language_model.model.layers.59.mlp.down_proj",
"language_model.model.layers.59.mlp.gate_proj",
"language_model.model.layers.59.mlp.up_proj",
"language_model.model.layers.59.self_attn.k_proj",
"language_model.model.layers.59.self_attn.o_proj",
"language_model.model.layers.59.self_attn.q_proj",
"language_model.model.layers.59.self_attn.v_proj",
"language_model.model.layers.6.linear_attn.in_proj_qkv",
"language_model.model.layers.6.linear_attn.in_proj_z",
"language_model.model.layers.6.linear_attn.out_proj",
"language_model.model.layers.6.mlp.down_proj",
"language_model.model.layers.6.mlp.gate_proj",
"language_model.model.layers.6.mlp.up_proj",
"language_model.model.layers.60.linear_attn.in_proj_qkv",
"language_model.model.layers.60.linear_attn.in_proj_z",
"language_model.model.layers.60.linear_attn.out_proj",
"language_model.model.layers.60.mlp.down_proj",
"language_model.model.layers.60.mlp.gate_proj",
"language_model.model.layers.60.mlp.up_proj",
"language_model.model.layers.61.linear_attn.in_proj_qkv",
"language_model.model.layers.61.linear_attn.in_proj_z",
"language_model.model.layers.61.linear_attn.out_proj",
"language_model.model.layers.61.mlp.down_proj",
"language_model.model.layers.61.mlp.gate_proj",
"language_model.model.layers.61.mlp.up_proj",
"language_model.model.layers.62.linear_attn.in_proj_qkv",
"language_model.model.layers.62.linear_attn.in_proj_z",
"language_model.model.layers.62.linear_attn.out_proj",
"language_model.model.layers.62.mlp.down_proj",
"language_model.model.layers.62.mlp.gate_proj",
"language_model.model.layers.62.mlp.up_proj",
"language_model.model.layers.63.mlp.down_proj",
"language_model.model.layers.63.mlp.gate_proj",
"language_model.model.layers.63.mlp.up_proj",
"language_model.model.layers.63.self_attn.k_proj",
"language_model.model.layers.63.self_attn.o_proj",
"language_model.model.layers.63.self_attn.q_proj",
"language_model.model.layers.63.self_attn.v_proj",
"language_model.model.layers.7.mlp.down_proj",
"language_model.model.layers.7.mlp.gate_proj",
"language_model.model.layers.7.mlp.up_proj",
"language_model.model.layers.7.self_attn.k_proj",
"language_model.model.layers.7.self_attn.o_proj",
"language_model.model.layers.7.self_attn.q_proj",
"language_model.model.layers.7.self_attn.v_proj",
"language_model.model.layers.8.linear_attn.in_proj_qkv",
"language_model.model.layers.8.linear_attn.in_proj_z",
"language_model.model.layers.8.linear_attn.out_proj",
"language_model.model.layers.8.mlp.down_proj",
"language_model.model.layers.8.mlp.gate_proj",
"language_model.model.layers.8.mlp.up_proj",
"language_model.model.layers.9.linear_attn.in_proj_qkv",
"language_model.model.layers.9.linear_attn.in_proj_z",
"language_model.model.layers.9.linear_attn.out_proj",
"language_model.model.layers.9.mlp.down_proj",
"language_model.model.layers.9.mlp.gate_proj",
"language_model.model.layers.9.mlp.up_proj"
],
"inverse_modules": [
"language_model.model.embed_tokens"
],
"gdn_v_grouped": true,
"note": "Language-model matrices are stored in a blockwise Hadamard-rotated basis. A loader MUST apply x -> H(signs*x) before every forward module matmul and y -> signs*H(y) after the embedding lookup, or refuse to load. Plain affine loaders return wrong output silently."
},
"source_model": {
"name": "Ternary-Bonsai-2-27B-mlx-2bit",
"repo": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit",
"model_type": "prism_hadamard_qwen35",
"base_model": "Qwen/Qwen3.8-27B",
"config_sha256": "238de7c512cc56a733421e3fd011d88f8260739e3d00e32c5d65b7943cc9f837",
"hadamard_sha256": "7132a3ec364f0bdac1f08f905f24f0ad2f14245060f592637a0396826d3b5fe6",
"model_safetensors_sha256": "130de5925082c168b7866b2e91b52e44abbafc99017e3ca352b77b5b55a269ed",
"dtype": "mlx-affine-2bit-ternary+float16-vision"
},
"architecture": {
"type": "qwen3_5",
"text_model_type": "qwen3_5_text",
"base_model": "Qwen3.8-27B",
"has_vision": true,
"has_ssm": true,
"has_moe": false,
"num_hidden_layers": 64,
"attn_output_gate": true
},
"layout": {
"key_layout": "mlx-vlm-qwen3_5",
"language_norms": "zero-centered-runtime-plus-one",
"shifted_norm_count": 161,
"linear_attn_conv1d": "mlx-layout-(channels,kernel,1)",
"linear_attn_state_projections": "float32 in_proj_a/in_proj_b (Prism keeps them unquantized)",
"gdn_activation_layout": "grouped",
"vision_patch_embed": "mlx-channel-last"
},
"runtime": {
"target": "vmlx-python",
"requires_hadamard_activation_transform": true,
"requires_jang_affine1_expansion": false,
"requires_jang_ternary_packed_expansion": true,
"bundle_has_mtp": false,
"mtp_layers": 0,
"mtp_mode": "none",
"mtp_num_speculative_tokens": 0,
"mtp_status": "no MTP tensors in bundle (Prism pack ships none); native speculative decode unavailable",
"total_weight_bytes": 6523610032,
"total_weight_gib": 6.076
},
"size_report": {
"bytes_by_class": {
"text_packed": 5877760000,
"text_signs": 11640832,
"text_float32": 104953856,
"vision_packed": 251582400,
"vision_float16": 277409248
},
"total_weight_bytes": 6523346336,
"total_weight_gib": 6.075
},
"capabilities": {
"reasoning_parser": "qwen3",
"tool_parser": "qwen3_coder",
"think_in_template": true,
"supports_tools": true,
"supports_thinking": true,
"family": "qwen3_5",
"modality": "multimodal",
"modalities": {
"text": true,
"vision": true,
"video": true,
"audio": false
},
"has_vision": true,
"has_audio": false,
"has_video": true,
"cache_type": "hybrid",
"default_reasoning": "on"
},
"chat": {
"sampling_defaults": {
"temperature": 1.0,
"top_p": 0.95,
"top_k": 20,
"min_p": 0.0,
"presence_penalty": 0.0,
"repetition_penalty": 1.0,
"source": "vendor_card+generation_config_2026-08-14",
"mode": "thinking"
},
"sampling_modes": {
"thinking": {
"temperature": 1.0,
"top_p": 0.95,
"top_k": 20,
"min_p": 0.0,
"presence_penalty": 0.0,
"repetition_penalty": 1.0
},
"instruct_nothinking": {
"temperature": 0.7,
"top_p": 0.8,
"top_k": 20,
"min_p": 0.0,
"presence_penalty": 1.5,
"repetition_penalty": 1.0
}
},
"stop_token_ids": [
248046,
248044
],
"recommended_max_tokens": {
"reasoning": 262144,
"final_response": 131072
},
"context_length": {
"native": 262144,
"extensible": 1000000
}
},
"reasoning": {
"supported": true,
"parser": "qwen3",
"default": "on",
"think_in_template": true,
"enable_kwarg": "enable_thinking",
"off_is_prefilled_closed_block": true,
"off_prefill": "\n\n\n\n",
"supported_reasoning_efforts": [
"low",
"medium",
"xhigh"
],
"default_reasoning_effort": "xhigh",
"reasoning_effort_transport": "chat_template_kwarg",
"preserve_thinking_supported": true,
"preserve_thinking_default": true,
"preserve_thinking_transport": "chat_template_kwarg",
"note": "Thinking is ON by default; disabling prefills a CLOSED think block. NEW in 3.8: reasoning_effort tiers xhigh (default) / medium / low — template raises on any other value. preserve_thinking is ON BY DEFAULT (verified empirically: no-kwarg render keeps history blocks) — the OPPOSITE of 3.6-style truncation; stable history improves prefix/KV cache reuse and agent decision consistency."
},
"tools": {
"supported": true,
"parser": "qwen3_coder",
"dialect": "xml_function",
"mlx_lm_autodetected": true
},
"vision": {
"supported": true,
"video_supported": true,
"tower": "qwen3_5 ViT (27 layers, hidden 1152)",
"processor": "preprocessor_config.json",
"video_processor": "video_preprocessor_config.json"
},
"drop_mtp": false,
"mtp": {
"num_layers": 0,
"artifact_available": false,
"tensor_count": 0,
"runtime_available": false,
"dedicated_embeddings": false,
"upstream_method": "qwen3_next_mtp",
"upstream_num_speculative_tokens": 2,
"trained_multi_step": true,
"recommended_num_drafts": 1,
"notation": "Draft count is the unambiguous unit. vmlx native-MTP 'depth' and vLLM num_speculative_tokens both count DRAFTS; kit docs' D counts tokens/cycle (kit D2 == 1 draft == vmlx depth 1)."
}
}