{ "format": "jang", "format_version": "2.0", "weight_format": "affine", "profile": "JANG_AFFINE_TERNARY_PACKED", "quantization": { "method": "jang-affine-discrete-ternary-lossless-repack+ternary-packed-26b-storage", "profile": "JANG_AFFINE_TERNARY_PACKED", "bits": 2, "block_size": 128, "group_size": 128, "mode": "affine", "quantization_scheme": "asymmetric", "quantization_backend": "prism-ternary-qat+mlx-native-affine", "bit_widths_used": [ 2, 6 ], "effective_bits_per_parameter": 1.9076, "tensor_quantization_manifest_schema": 2, "tensor_quantization_manifest_count": 485, "tensor_quantization_manifest": { "language_model.lm_head": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.lm_head.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.lm_head.signs" } }, "language_model.model.embed_tokens": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.embed_tokens.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "inverse", "signs_tensor": "language_model.model.embed_tokens.signs" } }, "language_model.model.layers.0.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.0.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.0.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.0.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.0.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.0.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.0.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.0.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.0.linear_attn.out_proj.signs" } }, "language_model.model.layers.0.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.0.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.0.mlp.down_proj.signs" } }, "language_model.model.layers.0.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.0.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.0.mlp.gate_proj.signs" } }, "language_model.model.layers.0.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.0.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.0.mlp.up_proj.signs" } }, "language_model.model.layers.1.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.1.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.1.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.1.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.1.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.1.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.1.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.1.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.1.linear_attn.out_proj.signs" } }, "language_model.model.layers.1.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.1.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.1.mlp.down_proj.signs" } }, "language_model.model.layers.1.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.1.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.1.mlp.gate_proj.signs" } }, "language_model.model.layers.1.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.1.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.1.mlp.up_proj.signs" } }, "language_model.model.layers.10.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.10.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.10.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.10.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.10.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.10.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.10.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.10.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.10.linear_attn.out_proj.signs" } }, "language_model.model.layers.10.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.10.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.10.mlp.down_proj.signs" } }, "language_model.model.layers.10.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.10.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.10.mlp.gate_proj.signs" } }, "language_model.model.layers.10.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.10.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.10.mlp.up_proj.signs" } }, "language_model.model.layers.11.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.mlp.down_proj.signs" } }, "language_model.model.layers.11.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.mlp.gate_proj.signs" } }, "language_model.model.layers.11.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.mlp.up_proj.signs" } }, "language_model.model.layers.11.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.self_attn.k_proj.signs" } }, "language_model.model.layers.11.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.self_attn.o_proj.signs" } }, "language_model.model.layers.11.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.self_attn.q_proj.signs" } }, "language_model.model.layers.11.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.11.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.11.self_attn.v_proj.signs" } }, "language_model.model.layers.12.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.12.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.12.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.12.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.12.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.12.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.12.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.12.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.12.linear_attn.out_proj.signs" } }, "language_model.model.layers.12.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.12.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.12.mlp.down_proj.signs" } }, "language_model.model.layers.12.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.12.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.12.mlp.gate_proj.signs" } }, "language_model.model.layers.12.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.12.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.12.mlp.up_proj.signs" } }, "language_model.model.layers.13.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.13.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.13.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.13.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.13.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.13.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.13.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.13.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.13.linear_attn.out_proj.signs" } }, "language_model.model.layers.13.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.13.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.13.mlp.down_proj.signs" } }, "language_model.model.layers.13.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.13.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.13.mlp.gate_proj.signs" } }, "language_model.model.layers.13.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.13.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.13.mlp.up_proj.signs" } }, "language_model.model.layers.14.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.14.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.14.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.14.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.14.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.14.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.14.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.14.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.14.linear_attn.out_proj.signs" } }, "language_model.model.layers.14.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.14.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.14.mlp.down_proj.signs" } }, "language_model.model.layers.14.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.14.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.14.mlp.gate_proj.signs" } }, "language_model.model.layers.14.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.14.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.14.mlp.up_proj.signs" } }, "language_model.model.layers.15.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.mlp.down_proj.signs" } }, "language_model.model.layers.15.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.mlp.gate_proj.signs" } }, "language_model.model.layers.15.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.mlp.up_proj.signs" } }, "language_model.model.layers.15.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.self_attn.k_proj.signs" } }, "language_model.model.layers.15.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.self_attn.o_proj.signs" } }, "language_model.model.layers.15.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.self_attn.q_proj.signs" } }, "language_model.model.layers.15.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.15.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.15.self_attn.v_proj.signs" } }, "language_model.model.layers.16.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.16.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.16.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.16.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.16.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.16.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.16.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.16.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.16.linear_attn.out_proj.signs" } }, "language_model.model.layers.16.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.16.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.16.mlp.down_proj.signs" } }, "language_model.model.layers.16.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.16.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.16.mlp.gate_proj.signs" } }, "language_model.model.layers.16.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.16.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.16.mlp.up_proj.signs" } }, "language_model.model.layers.17.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.17.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.17.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.17.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.17.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.17.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.17.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.17.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.17.linear_attn.out_proj.signs" } }, "language_model.model.layers.17.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.17.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.17.mlp.down_proj.signs" } }, "language_model.model.layers.17.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.17.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.17.mlp.gate_proj.signs" } }, "language_model.model.layers.17.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.17.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.17.mlp.up_proj.signs" } }, "language_model.model.layers.18.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.18.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.18.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.18.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.18.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.18.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.18.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.18.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.18.linear_attn.out_proj.signs" } }, "language_model.model.layers.18.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.18.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.18.mlp.down_proj.signs" } }, "language_model.model.layers.18.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.18.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.18.mlp.gate_proj.signs" } }, "language_model.model.layers.18.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.18.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.18.mlp.up_proj.signs" } }, "language_model.model.layers.19.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.mlp.down_proj.signs" } }, "language_model.model.layers.19.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.mlp.gate_proj.signs" } }, "language_model.model.layers.19.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.mlp.up_proj.signs" } }, "language_model.model.layers.19.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.self_attn.k_proj.signs" } }, "language_model.model.layers.19.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.self_attn.o_proj.signs" } }, "language_model.model.layers.19.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.self_attn.q_proj.signs" } }, "language_model.model.layers.19.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.19.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.19.self_attn.v_proj.signs" } }, "language_model.model.layers.2.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.2.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.2.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.2.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.2.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.2.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.2.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.2.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.2.linear_attn.out_proj.signs" } }, "language_model.model.layers.2.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.2.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.2.mlp.down_proj.signs" } }, "language_model.model.layers.2.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.2.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.2.mlp.gate_proj.signs" } }, "language_model.model.layers.2.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.2.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.2.mlp.up_proj.signs" } }, "language_model.model.layers.20.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.20.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.20.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.20.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.20.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.20.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.20.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.20.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.20.linear_attn.out_proj.signs" } }, "language_model.model.layers.20.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.20.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.20.mlp.down_proj.signs" } }, "language_model.model.layers.20.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.20.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.20.mlp.gate_proj.signs" } }, "language_model.model.layers.20.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.20.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.20.mlp.up_proj.signs" } }, "language_model.model.layers.21.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.21.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.21.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.21.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.21.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.21.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.21.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.21.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.21.linear_attn.out_proj.signs" } }, "language_model.model.layers.21.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.21.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.21.mlp.down_proj.signs" } }, "language_model.model.layers.21.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.21.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.21.mlp.gate_proj.signs" } }, "language_model.model.layers.21.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.21.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.21.mlp.up_proj.signs" } }, "language_model.model.layers.22.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.22.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.22.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.22.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.22.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.22.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.22.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.22.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.22.linear_attn.out_proj.signs" } }, "language_model.model.layers.22.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.22.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.22.mlp.down_proj.signs" } }, "language_model.model.layers.22.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.22.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.22.mlp.gate_proj.signs" } }, "language_model.model.layers.22.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.22.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.22.mlp.up_proj.signs" } }, "language_model.model.layers.23.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.mlp.down_proj.signs" } }, "language_model.model.layers.23.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.mlp.gate_proj.signs" } }, "language_model.model.layers.23.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.mlp.up_proj.signs" } }, "language_model.model.layers.23.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.self_attn.k_proj.signs" } }, "language_model.model.layers.23.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.self_attn.o_proj.signs" } }, "language_model.model.layers.23.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.self_attn.q_proj.signs" } }, "language_model.model.layers.23.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.23.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.23.self_attn.v_proj.signs" } }, "language_model.model.layers.24.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.24.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.24.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.24.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.24.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.24.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.24.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.24.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.24.linear_attn.out_proj.signs" } }, "language_model.model.layers.24.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.24.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.24.mlp.down_proj.signs" } }, "language_model.model.layers.24.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.24.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.24.mlp.gate_proj.signs" } }, "language_model.model.layers.24.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.24.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.24.mlp.up_proj.signs" } }, "language_model.model.layers.25.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.25.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.25.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.25.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.25.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.25.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.25.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.25.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.25.linear_attn.out_proj.signs" } }, "language_model.model.layers.25.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.25.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.25.mlp.down_proj.signs" } }, "language_model.model.layers.25.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.25.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.25.mlp.gate_proj.signs" } }, "language_model.model.layers.25.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.25.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.25.mlp.up_proj.signs" } }, "language_model.model.layers.26.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.26.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.26.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.26.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.26.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.26.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.26.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.26.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.26.linear_attn.out_proj.signs" } }, "language_model.model.layers.26.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.26.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.26.mlp.down_proj.signs" } }, "language_model.model.layers.26.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.26.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.26.mlp.gate_proj.signs" } }, "language_model.model.layers.26.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.26.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.26.mlp.up_proj.signs" } }, "language_model.model.layers.27.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.mlp.down_proj.signs" } }, "language_model.model.layers.27.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.mlp.gate_proj.signs" } }, "language_model.model.layers.27.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.mlp.up_proj.signs" } }, "language_model.model.layers.27.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.self_attn.k_proj.signs" } }, "language_model.model.layers.27.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.self_attn.o_proj.signs" } }, "language_model.model.layers.27.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.self_attn.q_proj.signs" } }, "language_model.model.layers.27.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.27.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.27.self_attn.v_proj.signs" } }, "language_model.model.layers.28.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.28.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.28.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.28.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.28.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.28.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.28.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.28.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.28.linear_attn.out_proj.signs" } }, "language_model.model.layers.28.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.28.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.28.mlp.down_proj.signs" } }, "language_model.model.layers.28.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.28.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.28.mlp.gate_proj.signs" } }, "language_model.model.layers.28.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.28.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.28.mlp.up_proj.signs" } }, "language_model.model.layers.29.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.29.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.29.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.29.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.29.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.29.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.29.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.29.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.29.linear_attn.out_proj.signs" } }, "language_model.model.layers.29.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.29.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.29.mlp.down_proj.signs" } }, "language_model.model.layers.29.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.29.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.29.mlp.gate_proj.signs" } }, "language_model.model.layers.29.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.29.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.29.mlp.up_proj.signs" } }, "language_model.model.layers.3.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.mlp.down_proj.signs" } }, "language_model.model.layers.3.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.mlp.gate_proj.signs" } }, "language_model.model.layers.3.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.mlp.up_proj.signs" } }, "language_model.model.layers.3.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.self_attn.k_proj.signs" } }, "language_model.model.layers.3.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.self_attn.o_proj.signs" } }, "language_model.model.layers.3.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.self_attn.q_proj.signs" } }, "language_model.model.layers.3.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.3.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.3.self_attn.v_proj.signs" } }, "language_model.model.layers.30.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.30.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.30.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.30.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.30.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.30.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.30.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.30.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.30.linear_attn.out_proj.signs" } }, "language_model.model.layers.30.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.30.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.30.mlp.down_proj.signs" } }, "language_model.model.layers.30.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.30.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.30.mlp.gate_proj.signs" } }, "language_model.model.layers.30.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.30.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.30.mlp.up_proj.signs" } }, "language_model.model.layers.31.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.mlp.down_proj.signs" } }, "language_model.model.layers.31.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.mlp.gate_proj.signs" } }, "language_model.model.layers.31.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.mlp.up_proj.signs" } }, "language_model.model.layers.31.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.self_attn.k_proj.signs" } }, "language_model.model.layers.31.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.self_attn.o_proj.signs" } }, "language_model.model.layers.31.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.self_attn.q_proj.signs" } }, "language_model.model.layers.31.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.31.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.31.self_attn.v_proj.signs" } }, "language_model.model.layers.32.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.32.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.32.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.32.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.32.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.32.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.32.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.32.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.32.linear_attn.out_proj.signs" } }, "language_model.model.layers.32.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.32.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.32.mlp.down_proj.signs" } }, "language_model.model.layers.32.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.32.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.32.mlp.gate_proj.signs" } }, "language_model.model.layers.32.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.32.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.32.mlp.up_proj.signs" } }, "language_model.model.layers.33.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.33.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.33.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.33.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.33.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.33.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.33.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.33.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.33.linear_attn.out_proj.signs" } }, "language_model.model.layers.33.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.33.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.33.mlp.down_proj.signs" } }, "language_model.model.layers.33.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.33.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.33.mlp.gate_proj.signs" } }, "language_model.model.layers.33.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.33.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.33.mlp.up_proj.signs" } }, "language_model.model.layers.34.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.34.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.34.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.34.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.34.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.34.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.34.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.34.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.34.linear_attn.out_proj.signs" } }, "language_model.model.layers.34.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.34.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.34.mlp.down_proj.signs" } }, "language_model.model.layers.34.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.34.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.34.mlp.gate_proj.signs" } }, "language_model.model.layers.34.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.34.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.34.mlp.up_proj.signs" } }, "language_model.model.layers.35.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.mlp.down_proj.signs" } }, "language_model.model.layers.35.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.mlp.gate_proj.signs" } }, "language_model.model.layers.35.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.mlp.up_proj.signs" } }, "language_model.model.layers.35.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.self_attn.k_proj.signs" } }, "language_model.model.layers.35.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.self_attn.o_proj.signs" } }, "language_model.model.layers.35.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.self_attn.q_proj.signs" } }, "language_model.model.layers.35.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.35.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.35.self_attn.v_proj.signs" } }, "language_model.model.layers.36.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.36.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.36.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.36.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.36.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.36.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.36.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.36.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.36.linear_attn.out_proj.signs" } }, "language_model.model.layers.36.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.36.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.36.mlp.down_proj.signs" } }, "language_model.model.layers.36.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.36.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.36.mlp.gate_proj.signs" } }, "language_model.model.layers.36.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.36.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.36.mlp.up_proj.signs" } }, "language_model.model.layers.37.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.37.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.37.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.37.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.37.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.37.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.37.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.37.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.37.linear_attn.out_proj.signs" } }, "language_model.model.layers.37.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.37.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.37.mlp.down_proj.signs" } }, "language_model.model.layers.37.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.37.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.37.mlp.gate_proj.signs" } }, "language_model.model.layers.37.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.37.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.37.mlp.up_proj.signs" } }, "language_model.model.layers.38.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.38.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.38.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.38.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.38.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.38.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.38.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.38.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.38.linear_attn.out_proj.signs" } }, "language_model.model.layers.38.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.38.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.38.mlp.down_proj.signs" } }, "language_model.model.layers.38.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.38.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.38.mlp.gate_proj.signs" } }, "language_model.model.layers.38.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.38.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.38.mlp.up_proj.signs" } }, "language_model.model.layers.39.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.mlp.down_proj.signs" } }, "language_model.model.layers.39.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.mlp.gate_proj.signs" } }, "language_model.model.layers.39.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.mlp.up_proj.signs" } }, "language_model.model.layers.39.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.self_attn.k_proj.signs" } }, "language_model.model.layers.39.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.self_attn.o_proj.signs" } }, "language_model.model.layers.39.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.self_attn.q_proj.signs" } }, "language_model.model.layers.39.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.39.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.39.self_attn.v_proj.signs" } }, "language_model.model.layers.4.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.4.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.4.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.4.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.4.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.4.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.4.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.4.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.4.linear_attn.out_proj.signs" } }, "language_model.model.layers.4.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.4.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.4.mlp.down_proj.signs" } }, "language_model.model.layers.4.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.4.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.4.mlp.gate_proj.signs" } }, "language_model.model.layers.4.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.4.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.4.mlp.up_proj.signs" } }, "language_model.model.layers.40.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.40.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.40.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.40.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.40.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.40.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.40.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.40.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.40.linear_attn.out_proj.signs" } }, "language_model.model.layers.40.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.40.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.40.mlp.down_proj.signs" } }, "language_model.model.layers.40.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.40.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.40.mlp.gate_proj.signs" } }, "language_model.model.layers.40.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.40.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.40.mlp.up_proj.signs" } }, "language_model.model.layers.41.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.41.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.41.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.41.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.41.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.41.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.41.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.41.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.41.linear_attn.out_proj.signs" } }, "language_model.model.layers.41.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.41.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.41.mlp.down_proj.signs" } }, "language_model.model.layers.41.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.41.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.41.mlp.gate_proj.signs" } }, "language_model.model.layers.41.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.41.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.41.mlp.up_proj.signs" } }, "language_model.model.layers.42.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.42.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.42.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.42.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.42.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.42.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.42.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.42.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.42.linear_attn.out_proj.signs" } }, "language_model.model.layers.42.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.42.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.42.mlp.down_proj.signs" } }, "language_model.model.layers.42.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.42.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.42.mlp.gate_proj.signs" } }, "language_model.model.layers.42.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.42.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.42.mlp.up_proj.signs" } }, "language_model.model.layers.43.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.mlp.down_proj.signs" } }, "language_model.model.layers.43.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.mlp.gate_proj.signs" } }, "language_model.model.layers.43.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.mlp.up_proj.signs" } }, "language_model.model.layers.43.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.self_attn.k_proj.signs" } }, "language_model.model.layers.43.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.self_attn.o_proj.signs" } }, "language_model.model.layers.43.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.self_attn.q_proj.signs" } }, "language_model.model.layers.43.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.43.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.43.self_attn.v_proj.signs" } }, "language_model.model.layers.44.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.44.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.44.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.44.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.44.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.44.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.44.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.44.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.44.linear_attn.out_proj.signs" } }, "language_model.model.layers.44.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.44.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.44.mlp.down_proj.signs" } }, "language_model.model.layers.44.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.44.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.44.mlp.gate_proj.signs" } }, "language_model.model.layers.44.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.44.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.44.mlp.up_proj.signs" } }, "language_model.model.layers.45.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.45.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.45.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.45.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.45.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.45.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.45.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.45.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.45.linear_attn.out_proj.signs" } }, "language_model.model.layers.45.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.45.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.45.mlp.down_proj.signs" } }, "language_model.model.layers.45.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.45.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.45.mlp.gate_proj.signs" } }, "language_model.model.layers.45.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.45.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.45.mlp.up_proj.signs" } }, "language_model.model.layers.46.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.46.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.46.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.46.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.46.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.46.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.46.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.46.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.46.linear_attn.out_proj.signs" } }, "language_model.model.layers.46.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.46.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.46.mlp.down_proj.signs" } }, "language_model.model.layers.46.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.46.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.46.mlp.gate_proj.signs" } }, "language_model.model.layers.46.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.46.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.46.mlp.up_proj.signs" } }, "language_model.model.layers.47.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.mlp.down_proj.signs" } }, "language_model.model.layers.47.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.mlp.gate_proj.signs" } }, "language_model.model.layers.47.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.mlp.up_proj.signs" } }, "language_model.model.layers.47.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.self_attn.k_proj.signs" } }, "language_model.model.layers.47.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.self_attn.o_proj.signs" } }, "language_model.model.layers.47.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.self_attn.q_proj.signs" } }, "language_model.model.layers.47.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.47.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.47.self_attn.v_proj.signs" } }, "language_model.model.layers.48.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.48.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.48.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.48.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.48.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.48.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.48.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.48.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.48.linear_attn.out_proj.signs" } }, "language_model.model.layers.48.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.48.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.48.mlp.down_proj.signs" } }, "language_model.model.layers.48.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.48.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.48.mlp.gate_proj.signs" } }, "language_model.model.layers.48.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.48.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.48.mlp.up_proj.signs" } }, "language_model.model.layers.49.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.49.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.49.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.49.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.49.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.49.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.49.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.49.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.49.linear_attn.out_proj.signs" } }, "language_model.model.layers.49.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.49.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.49.mlp.down_proj.signs" } }, "language_model.model.layers.49.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.49.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.49.mlp.gate_proj.signs" } }, "language_model.model.layers.49.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.49.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.49.mlp.up_proj.signs" } }, "language_model.model.layers.5.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.5.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.5.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.5.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.5.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.5.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.5.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.5.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.5.linear_attn.out_proj.signs" } }, "language_model.model.layers.5.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.5.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.5.mlp.down_proj.signs" } }, "language_model.model.layers.5.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.5.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.5.mlp.gate_proj.signs" } }, "language_model.model.layers.5.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.5.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.5.mlp.up_proj.signs" } }, "language_model.model.layers.50.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.50.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.50.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.50.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.50.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.50.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.50.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.50.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.50.linear_attn.out_proj.signs" } }, "language_model.model.layers.50.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.50.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.50.mlp.down_proj.signs" } }, "language_model.model.layers.50.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.50.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.50.mlp.gate_proj.signs" } }, "language_model.model.layers.50.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.50.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.50.mlp.up_proj.signs" } }, "language_model.model.layers.51.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.mlp.down_proj.signs" } }, "language_model.model.layers.51.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.mlp.gate_proj.signs" } }, "language_model.model.layers.51.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.mlp.up_proj.signs" } }, "language_model.model.layers.51.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.self_attn.k_proj.signs" } }, "language_model.model.layers.51.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.self_attn.o_proj.signs" } }, "language_model.model.layers.51.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.self_attn.q_proj.signs" } }, "language_model.model.layers.51.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.51.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.51.self_attn.v_proj.signs" } }, "language_model.model.layers.52.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.52.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.52.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.52.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.52.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.52.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.52.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.52.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.52.linear_attn.out_proj.signs" } }, "language_model.model.layers.52.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.52.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.52.mlp.down_proj.signs" } }, "language_model.model.layers.52.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.52.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.52.mlp.gate_proj.signs" } }, "language_model.model.layers.52.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.52.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.52.mlp.up_proj.signs" } }, "language_model.model.layers.53.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.53.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.53.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.53.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.53.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.53.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.53.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.53.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.53.linear_attn.out_proj.signs" } }, "language_model.model.layers.53.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.53.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.53.mlp.down_proj.signs" } }, "language_model.model.layers.53.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.53.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.53.mlp.gate_proj.signs" } }, "language_model.model.layers.53.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.53.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.53.mlp.up_proj.signs" } }, "language_model.model.layers.54.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.54.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.54.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.54.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.54.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.54.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.54.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.54.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.54.linear_attn.out_proj.signs" } }, "language_model.model.layers.54.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.54.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.54.mlp.down_proj.signs" } }, "language_model.model.layers.54.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.54.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.54.mlp.gate_proj.signs" } }, "language_model.model.layers.54.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.54.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.54.mlp.up_proj.signs" } }, "language_model.model.layers.55.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.mlp.down_proj.signs" } }, "language_model.model.layers.55.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.mlp.gate_proj.signs" } }, "language_model.model.layers.55.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.mlp.up_proj.signs" } }, "language_model.model.layers.55.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.self_attn.k_proj.signs" } }, "language_model.model.layers.55.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.self_attn.o_proj.signs" } }, "language_model.model.layers.55.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.self_attn.q_proj.signs" } }, "language_model.model.layers.55.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.55.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.55.self_attn.v_proj.signs" } }, "language_model.model.layers.56.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.56.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.56.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.56.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.56.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.56.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.56.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.56.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.56.linear_attn.out_proj.signs" } }, "language_model.model.layers.56.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.56.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.56.mlp.down_proj.signs" } }, "language_model.model.layers.56.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.56.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.56.mlp.gate_proj.signs" } }, "language_model.model.layers.56.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.56.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.56.mlp.up_proj.signs" } }, "language_model.model.layers.57.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.57.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.57.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.57.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.57.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.57.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.57.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.57.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.57.linear_attn.out_proj.signs" } }, "language_model.model.layers.57.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.57.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.57.mlp.down_proj.signs" } }, "language_model.model.layers.57.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.57.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.57.mlp.gate_proj.signs" } }, "language_model.model.layers.57.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.57.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.57.mlp.up_proj.signs" } }, "language_model.model.layers.58.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.58.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.58.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.58.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.58.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.58.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.58.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.58.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.58.linear_attn.out_proj.signs" } }, "language_model.model.layers.58.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.58.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.58.mlp.down_proj.signs" } }, "language_model.model.layers.58.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.58.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.58.mlp.gate_proj.signs" } }, "language_model.model.layers.58.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.58.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.58.mlp.up_proj.signs" } }, "language_model.model.layers.59.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.mlp.down_proj.signs" } }, "language_model.model.layers.59.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.mlp.gate_proj.signs" } }, "language_model.model.layers.59.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.mlp.up_proj.signs" } }, "language_model.model.layers.59.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.self_attn.k_proj.signs" } }, "language_model.model.layers.59.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.self_attn.o_proj.signs" } }, "language_model.model.layers.59.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.self_attn.q_proj.signs" } }, "language_model.model.layers.59.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.59.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.59.self_attn.v_proj.signs" } }, "language_model.model.layers.6.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.6.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.6.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.6.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.6.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.6.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.6.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.6.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.6.linear_attn.out_proj.signs" } }, "language_model.model.layers.6.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.6.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.6.mlp.down_proj.signs" } }, "language_model.model.layers.6.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.6.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.6.mlp.gate_proj.signs" } }, "language_model.model.layers.6.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.6.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.6.mlp.up_proj.signs" } }, "language_model.model.layers.60.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.60.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.60.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.60.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.60.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.60.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.60.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.60.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.60.linear_attn.out_proj.signs" } }, "language_model.model.layers.60.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.60.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.60.mlp.down_proj.signs" } }, "language_model.model.layers.60.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.60.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.60.mlp.gate_proj.signs" } }, "language_model.model.layers.60.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.60.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.60.mlp.up_proj.signs" } }, "language_model.model.layers.61.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.61.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.61.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.61.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.61.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.61.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.61.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.61.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.61.linear_attn.out_proj.signs" } }, "language_model.model.layers.61.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.61.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.61.mlp.down_proj.signs" } }, "language_model.model.layers.61.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.61.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.61.mlp.gate_proj.signs" } }, "language_model.model.layers.61.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.61.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.61.mlp.up_proj.signs" } }, "language_model.model.layers.62.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.62.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.62.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.62.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.62.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.62.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.62.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.62.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.62.linear_attn.out_proj.signs" } }, "language_model.model.layers.62.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.62.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.62.mlp.down_proj.signs" } }, "language_model.model.layers.62.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.62.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.62.mlp.gate_proj.signs" } }, "language_model.model.layers.62.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.62.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.62.mlp.up_proj.signs" } }, "language_model.model.layers.63.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.mlp.down_proj.signs" } }, "language_model.model.layers.63.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.mlp.gate_proj.signs" } }, "language_model.model.layers.63.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.mlp.up_proj.signs" } }, "language_model.model.layers.63.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.self_attn.k_proj.signs" } }, "language_model.model.layers.63.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.self_attn.o_proj.signs" } }, "language_model.model.layers.63.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.self_attn.q_proj.signs" } }, "language_model.model.layers.63.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.63.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.63.self_attn.v_proj.signs" } }, "language_model.model.layers.7.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.mlp.down_proj.signs" } }, "language_model.model.layers.7.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.mlp.gate_proj.signs" } }, "language_model.model.layers.7.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.mlp.up_proj.signs" } }, "language_model.model.layers.7.self_attn.k_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.self_attn.k_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.self_attn.k_proj.signs" } }, "language_model.model.layers.7.self_attn.o_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.self_attn.o_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.self_attn.o_proj.signs" } }, "language_model.model.layers.7.self_attn.q_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.self_attn.q_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.self_attn.q_proj.signs" } }, "language_model.model.layers.7.self_attn.v_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.7.self_attn.v_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.7.self_attn.v_proj.signs" } }, "language_model.model.layers.8.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.8.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.8.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.8.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.8.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.8.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.8.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.8.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.8.linear_attn.out_proj.signs" } }, "language_model.model.layers.8.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.8.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.8.mlp.down_proj.signs" } }, "language_model.model.layers.8.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.8.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.8.mlp.gate_proj.signs" } }, "language_model.model.layers.8.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.8.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.8.mlp.up_proj.signs" } }, "language_model.model.layers.9.linear_attn.in_proj_qkv": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.9.linear_attn.in_proj_qkv.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.9.linear_attn.in_proj_qkv.signs" } }, "language_model.model.layers.9.linear_attn.in_proj_z": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.9.linear_attn.in_proj_z.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.9.linear_attn.in_proj_z.signs" } }, "language_model.model.layers.9.linear_attn.out_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.9.linear_attn.out_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.9.linear_attn.out_proj.signs" } }, "language_model.model.layers.9.mlp.down_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.9.mlp.down_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.9.mlp.down_proj.signs" } }, "language_model.model.layers.9.mlp.gate_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.9.mlp.gate_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.9.mlp.gate_proj.signs" } }, "language_model.model.layers.9.mlp.up_proj": { "bits": 2, "storage": "ternary_packed_26b", "runtime_bits": 2, "storage_layout": "uint8 [rows, groups*26]: 5 base-3 trits per byte, 125+3 per 128-group; float16 scale; bias materialized as -scale at load", "group_size": 128, "mode": "affine", "source_tensor": "language_model.model.layers.9.mlp.up_proj.weight", "discrete_levels": "ternary", "discrete_levels_exact": true, "lossless_repack": true, "sidecar_dtype": "float16", "hadamard": { "block_size": 1024, "direction": "forward", "signs_tensor": "language_model.model.layers.9.mlp.up_proj.signs" } }, "vision_tower.blocks.0.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.0.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.03114671885613714 }, "vision_tower.blocks.0.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.0.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.0487284327605782 }, "vision_tower.blocks.0.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.0.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.033788636898414395 }, "vision_tower.blocks.1.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.1.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02980344647171637 }, "vision_tower.blocks.1.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.1.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.032480140914934494 }, "vision_tower.blocks.1.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.1.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.03178094575174044 }, "vision_tower.blocks.10.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.10.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026820783474042126 }, "vision_tower.blocks.10.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.10.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026998819519493993 }, "vision_tower.blocks.10.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.10.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026438517061131678 }, "vision_tower.blocks.11.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.11.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026185750542824886 }, "vision_tower.blocks.11.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.11.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02689954865214691 }, "vision_tower.blocks.11.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.11.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02631248273082319 }, "vision_tower.blocks.12.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.12.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026333623669749968 }, "vision_tower.blocks.12.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.12.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02680343750980103 }, "vision_tower.blocks.12.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.12.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02626799103183913 }, "vision_tower.blocks.13.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.13.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026153772089506755 }, "vision_tower.blocks.13.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.13.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026434027094361934 }, "vision_tower.blocks.13.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.13.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026251108613823324 }, "vision_tower.blocks.14.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.14.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026055507552693227 }, "vision_tower.blocks.14.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.14.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026453777577897054 }, "vision_tower.blocks.14.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.14.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02635079293446125 }, "vision_tower.blocks.15.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.15.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02595919801654032 }, "vision_tower.blocks.15.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.15.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02626547619045524 }, "vision_tower.blocks.15.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.15.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02609709633686056 }, "vision_tower.blocks.16.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.16.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.025974845182214643 }, "vision_tower.blocks.16.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.16.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026260896275524796 }, "vision_tower.blocks.16.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.16.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02650049096996159 }, "vision_tower.blocks.17.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.17.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.025891218492353665 }, "vision_tower.blocks.17.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.17.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026208745900798587 }, "vision_tower.blocks.17.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.17.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026795070907207393 }, "vision_tower.blocks.18.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.18.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.0259538797980769 }, "vision_tower.blocks.18.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.18.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026178578285044815 }, "vision_tower.blocks.18.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.18.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02683145098234242 }, "vision_tower.blocks.19.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.19.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02586491260979267 }, "vision_tower.blocks.19.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.19.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02617873507213997 }, "vision_tower.blocks.19.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.19.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027257697755729754 }, "vision_tower.blocks.2.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.2.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.028295275640551325 }, "vision_tower.blocks.2.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.2.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02934867177751939 }, "vision_tower.blocks.2.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.2.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.029143837846171142 }, "vision_tower.blocks.20.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.20.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.025928789813477227 }, "vision_tower.blocks.20.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.20.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02621052058388975 }, "vision_tower.blocks.20.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.20.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02768317267560894 }, "vision_tower.blocks.21.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.21.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02597828961826833 }, "vision_tower.blocks.21.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.21.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026338514899102675 }, "vision_tower.blocks.21.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.21.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027944574991906976 }, "vision_tower.blocks.22.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.22.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026170884279043058 }, "vision_tower.blocks.22.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.22.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02639189096897599 }, "vision_tower.blocks.22.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.22.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.028006104412855167 }, "vision_tower.blocks.23.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.23.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02686725732846684 }, "vision_tower.blocks.23.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.23.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02660456080651205 }, "vision_tower.blocks.23.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.23.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02797980650899829 }, "vision_tower.blocks.24.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.24.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02602861346872952 }, "vision_tower.blocks.24.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.24.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02648298324928136 }, "vision_tower.blocks.24.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.24.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027885463171170695 }, "vision_tower.blocks.25.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.25.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026437849557134407 }, "vision_tower.blocks.25.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.25.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026586951697741668 }, "vision_tower.blocks.25.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.25.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027524776901542404 }, "vision_tower.blocks.26.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.26.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.029074117040414477 }, "vision_tower.blocks.26.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.26.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026593394962008653 }, "vision_tower.blocks.26.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.26.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026766419440602488 }, "vision_tower.blocks.3.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.3.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026748051244855697 }, "vision_tower.blocks.3.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.3.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.028464130663524545 }, "vision_tower.blocks.3.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.3.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027517339159885915 }, "vision_tower.blocks.4.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.4.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02693300194775943 }, "vision_tower.blocks.4.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.4.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.028091346675528494 }, "vision_tower.blocks.4.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.4.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02759703199055213 }, "vision_tower.blocks.5.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.5.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026579687105911656 }, "vision_tower.blocks.5.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.5.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027596807262290267 }, "vision_tower.blocks.5.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.5.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02721476903189207 }, "vision_tower.blocks.6.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.6.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026263941350228213 }, "vision_tower.blocks.6.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.6.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027521537916453825 }, "vision_tower.blocks.6.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.6.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02701156427800195 }, "vision_tower.blocks.7.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.7.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.0263431292589065 }, "vision_tower.blocks.7.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.7.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027386463354745046 }, "vision_tower.blocks.7.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.7.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026949626009427817 }, "vision_tower.blocks.8.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.8.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026436758931145107 }, "vision_tower.blocks.8.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.8.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.027462590637701314 }, "vision_tower.blocks.8.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.8.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026798403689806218 }, "vision_tower.blocks.9.attn.proj": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.9.attn.proj.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.026128159544739384 }, "vision_tower.blocks.9.attn.qkv": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.9.attn.qkv.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.0268437156643466 }, "vision_tower.blocks.9.mlp.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.blocks.9.mlp.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02626577295136895 }, "vision_tower.merger.linear_fc1": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.merger.linear_fc1.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.02613966335614916 }, "vision_tower.merger.linear_fc2": { "bits": 6, "storage_bits": 6, "group_size": 128, "mode": "affine", "source_tensor": "vision_tower.merger.linear_fc2.weight", "method": "native-affine-rtn", "lossless_source_reconstruction": false, "source_rel_l1": 0.0258531285573422 } }, "passthrough_tensor_count": 699, "passthrough_parameter_count": 164943088, "calibration": { "awq": "not applicable: language weights are exact QAT ternary from Prism; no full-precision source exists", "imatrix": "not applicable: same reason; F16 GGUF is the identical dequantized ternary", "gptq": "not applicable", "vision_tower": "plain round-to-nearest native affine 6-bit/g128 (no calibration)" }, "ternary_packed_runtime_expansion": { "storage": "ternary_packed_26b", "runtime_bits": 2, "group_size": 128, "lossless": true, "scales_unchanged": true, "biases": "materialized as -scales at load", "disk_bits_per_weight_incl_scale": 1.75 }, "language_model": { "modules": 402, "storage": "uint8 base-3 trits (26 B per 128) + float16 scale=s; float32 signs; bias=-s materialized at load", "lossless_repack_of": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit" }, "vision_tower": { "modules": 83, "bits": 6, "group_size": 128, "float16_passthrough": "blocks.N.mlp.linear_fc2 (in=4304), pos_embed, patch_embed, norms, biases" } }, "hadamard": { "contract": "prism.hadamard.v1", "sidecar": "hadamard.json", "block_size": 1024, "transform": "normalized-sylvester-walsh-hadamard", "axis": "input-last-dimension", "sign_mode": "explicit", "signs_dtype": "float32", "signs_tensor_suffix": "signs", "compute_dtype": "float32", "forward_modules": [ "language_model.lm_head", "language_model.model.layers.0.linear_attn.in_proj_qkv", "language_model.model.layers.0.linear_attn.in_proj_z", "language_model.model.layers.0.linear_attn.out_proj", "language_model.model.layers.0.mlp.down_proj", "language_model.model.layers.0.mlp.gate_proj", "language_model.model.layers.0.mlp.up_proj", "language_model.model.layers.1.linear_attn.in_proj_qkv", "language_model.model.layers.1.linear_attn.in_proj_z", "language_model.model.layers.1.linear_attn.out_proj", "language_model.model.layers.1.mlp.down_proj", "language_model.model.layers.1.mlp.gate_proj", "language_model.model.layers.1.mlp.up_proj", "language_model.model.layers.10.linear_attn.in_proj_qkv", "language_model.model.layers.10.linear_attn.in_proj_z", "language_model.model.layers.10.linear_attn.out_proj", "language_model.model.layers.10.mlp.down_proj", "language_model.model.layers.10.mlp.gate_proj", "language_model.model.layers.10.mlp.up_proj", "language_model.model.layers.11.mlp.down_proj", "language_model.model.layers.11.mlp.gate_proj", "language_model.model.layers.11.mlp.up_proj", "language_model.model.layers.11.self_attn.k_proj", "language_model.model.layers.11.self_attn.o_proj", "language_model.model.layers.11.self_attn.q_proj", "language_model.model.layers.11.self_attn.v_proj", "language_model.model.layers.12.linear_attn.in_proj_qkv", "language_model.model.layers.12.linear_attn.in_proj_z", "language_model.model.layers.12.linear_attn.out_proj", "language_model.model.layers.12.mlp.down_proj", "language_model.model.layers.12.mlp.gate_proj", "language_model.model.layers.12.mlp.up_proj", "language_model.model.layers.13.linear_attn.in_proj_qkv", "language_model.model.layers.13.linear_attn.in_proj_z", "language_model.model.layers.13.linear_attn.out_proj", "language_model.model.layers.13.mlp.down_proj", "language_model.model.layers.13.mlp.gate_proj", "language_model.model.layers.13.mlp.up_proj", "language_model.model.layers.14.linear_attn.in_proj_qkv", "language_model.model.layers.14.linear_attn.in_proj_z", "language_model.model.layers.14.linear_attn.out_proj", "language_model.model.layers.14.mlp.down_proj", "language_model.model.layers.14.mlp.gate_proj", "language_model.model.layers.14.mlp.up_proj", "language_model.model.layers.15.mlp.down_proj", "language_model.model.layers.15.mlp.gate_proj", "language_model.model.layers.15.mlp.up_proj", "language_model.model.layers.15.self_attn.k_proj", "language_model.model.layers.15.self_attn.o_proj", "language_model.model.layers.15.self_attn.q_proj", "language_model.model.layers.15.self_attn.v_proj", "language_model.model.layers.16.linear_attn.in_proj_qkv", "language_model.model.layers.16.linear_attn.in_proj_z", "language_model.model.layers.16.linear_attn.out_proj", "language_model.model.layers.16.mlp.down_proj", "language_model.model.layers.16.mlp.gate_proj", "language_model.model.layers.16.mlp.up_proj", "language_model.model.layers.17.linear_attn.in_proj_qkv", "language_model.model.layers.17.linear_attn.in_proj_z", "language_model.model.layers.17.linear_attn.out_proj", "language_model.model.layers.17.mlp.down_proj", "language_model.model.layers.17.mlp.gate_proj", "language_model.model.layers.17.mlp.up_proj", "language_model.model.layers.18.linear_attn.in_proj_qkv", "language_model.model.layers.18.linear_attn.in_proj_z", "language_model.model.layers.18.linear_attn.out_proj", "language_model.model.layers.18.mlp.down_proj", "language_model.model.layers.18.mlp.gate_proj", "language_model.model.layers.18.mlp.up_proj", "language_model.model.layers.19.mlp.down_proj", "language_model.model.layers.19.mlp.gate_proj", "language_model.model.layers.19.mlp.up_proj", "language_model.model.layers.19.self_attn.k_proj", "language_model.model.layers.19.self_attn.o_proj", "language_model.model.layers.19.self_attn.q_proj", "language_model.model.layers.19.self_attn.v_proj", "language_model.model.layers.2.linear_attn.in_proj_qkv", "language_model.model.layers.2.linear_attn.in_proj_z", "language_model.model.layers.2.linear_attn.out_proj", "language_model.model.layers.2.mlp.down_proj", "language_model.model.layers.2.mlp.gate_proj", "language_model.model.layers.2.mlp.up_proj", "language_model.model.layers.20.linear_attn.in_proj_qkv", "language_model.model.layers.20.linear_attn.in_proj_z", "language_model.model.layers.20.linear_attn.out_proj", "language_model.model.layers.20.mlp.down_proj", "language_model.model.layers.20.mlp.gate_proj", "language_model.model.layers.20.mlp.up_proj", "language_model.model.layers.21.linear_attn.in_proj_qkv", "language_model.model.layers.21.linear_attn.in_proj_z", "language_model.model.layers.21.linear_attn.out_proj", "language_model.model.layers.21.mlp.down_proj", "language_model.model.layers.21.mlp.gate_proj", "language_model.model.layers.21.mlp.up_proj", "language_model.model.layers.22.linear_attn.in_proj_qkv", "language_model.model.layers.22.linear_attn.in_proj_z", "language_model.model.layers.22.linear_attn.out_proj", "language_model.model.layers.22.mlp.down_proj", "language_model.model.layers.22.mlp.gate_proj", "language_model.model.layers.22.mlp.up_proj", "language_model.model.layers.23.mlp.down_proj", "language_model.model.layers.23.mlp.gate_proj", "language_model.model.layers.23.mlp.up_proj", "language_model.model.layers.23.self_attn.k_proj", "language_model.model.layers.23.self_attn.o_proj", "language_model.model.layers.23.self_attn.q_proj", "language_model.model.layers.23.self_attn.v_proj", "language_model.model.layers.24.linear_attn.in_proj_qkv", "language_model.model.layers.24.linear_attn.in_proj_z", "language_model.model.layers.24.linear_attn.out_proj", "language_model.model.layers.24.mlp.down_proj", "language_model.model.layers.24.mlp.gate_proj", "language_model.model.layers.24.mlp.up_proj", "language_model.model.layers.25.linear_attn.in_proj_qkv", "language_model.model.layers.25.linear_attn.in_proj_z", "language_model.model.layers.25.linear_attn.out_proj", "language_model.model.layers.25.mlp.down_proj", "language_model.model.layers.25.mlp.gate_proj", "language_model.model.layers.25.mlp.up_proj", "language_model.model.layers.26.linear_attn.in_proj_qkv", "language_model.model.layers.26.linear_attn.in_proj_z", "language_model.model.layers.26.linear_attn.out_proj", "language_model.model.layers.26.mlp.down_proj", "language_model.model.layers.26.mlp.gate_proj", "language_model.model.layers.26.mlp.up_proj", "language_model.model.layers.27.mlp.down_proj", "language_model.model.layers.27.mlp.gate_proj", "language_model.model.layers.27.mlp.up_proj", "language_model.model.layers.27.self_attn.k_proj", "language_model.model.layers.27.self_attn.o_proj", "language_model.model.layers.27.self_attn.q_proj", "language_model.model.layers.27.self_attn.v_proj", "language_model.model.layers.28.linear_attn.in_proj_qkv", "language_model.model.layers.28.linear_attn.in_proj_z", "language_model.model.layers.28.linear_attn.out_proj", "language_model.model.layers.28.mlp.down_proj", "language_model.model.layers.28.mlp.gate_proj", "language_model.model.layers.28.mlp.up_proj", "language_model.model.layers.29.linear_attn.in_proj_qkv", "language_model.model.layers.29.linear_attn.in_proj_z", "language_model.model.layers.29.linear_attn.out_proj", "language_model.model.layers.29.mlp.down_proj", "language_model.model.layers.29.mlp.gate_proj", "language_model.model.layers.29.mlp.up_proj", "language_model.model.layers.3.mlp.down_proj", "language_model.model.layers.3.mlp.gate_proj", "language_model.model.layers.3.mlp.up_proj", "language_model.model.layers.3.self_attn.k_proj", "language_model.model.layers.3.self_attn.o_proj", "language_model.model.layers.3.self_attn.q_proj", "language_model.model.layers.3.self_attn.v_proj", "language_model.model.layers.30.linear_attn.in_proj_qkv", "language_model.model.layers.30.linear_attn.in_proj_z", "language_model.model.layers.30.linear_attn.out_proj", "language_model.model.layers.30.mlp.down_proj", "language_model.model.layers.30.mlp.gate_proj", "language_model.model.layers.30.mlp.up_proj", "language_model.model.layers.31.mlp.down_proj", "language_model.model.layers.31.mlp.gate_proj", "language_model.model.layers.31.mlp.up_proj", "language_model.model.layers.31.self_attn.k_proj", "language_model.model.layers.31.self_attn.o_proj", "language_model.model.layers.31.self_attn.q_proj", "language_model.model.layers.31.self_attn.v_proj", "language_model.model.layers.32.linear_attn.in_proj_qkv", "language_model.model.layers.32.linear_attn.in_proj_z", "language_model.model.layers.32.linear_attn.out_proj", "language_model.model.layers.32.mlp.down_proj", "language_model.model.layers.32.mlp.gate_proj", "language_model.model.layers.32.mlp.up_proj", "language_model.model.layers.33.linear_attn.in_proj_qkv", "language_model.model.layers.33.linear_attn.in_proj_z", "language_model.model.layers.33.linear_attn.out_proj", "language_model.model.layers.33.mlp.down_proj", "language_model.model.layers.33.mlp.gate_proj", "language_model.model.layers.33.mlp.up_proj", "language_model.model.layers.34.linear_attn.in_proj_qkv", "language_model.model.layers.34.linear_attn.in_proj_z", "language_model.model.layers.34.linear_attn.out_proj", "language_model.model.layers.34.mlp.down_proj", "language_model.model.layers.34.mlp.gate_proj", "language_model.model.layers.34.mlp.up_proj", "language_model.model.layers.35.mlp.down_proj", "language_model.model.layers.35.mlp.gate_proj", "language_model.model.layers.35.mlp.up_proj", "language_model.model.layers.35.self_attn.k_proj", "language_model.model.layers.35.self_attn.o_proj", "language_model.model.layers.35.self_attn.q_proj", "language_model.model.layers.35.self_attn.v_proj", "language_model.model.layers.36.linear_attn.in_proj_qkv", "language_model.model.layers.36.linear_attn.in_proj_z", "language_model.model.layers.36.linear_attn.out_proj", "language_model.model.layers.36.mlp.down_proj", "language_model.model.layers.36.mlp.gate_proj", "language_model.model.layers.36.mlp.up_proj", "language_model.model.layers.37.linear_attn.in_proj_qkv", "language_model.model.layers.37.linear_attn.in_proj_z", "language_model.model.layers.37.linear_attn.out_proj", "language_model.model.layers.37.mlp.down_proj", "language_model.model.layers.37.mlp.gate_proj", "language_model.model.layers.37.mlp.up_proj", "language_model.model.layers.38.linear_attn.in_proj_qkv", "language_model.model.layers.38.linear_attn.in_proj_z", "language_model.model.layers.38.linear_attn.out_proj", "language_model.model.layers.38.mlp.down_proj", "language_model.model.layers.38.mlp.gate_proj", "language_model.model.layers.38.mlp.up_proj", "language_model.model.layers.39.mlp.down_proj", "language_model.model.layers.39.mlp.gate_proj", "language_model.model.layers.39.mlp.up_proj", "language_model.model.layers.39.self_attn.k_proj", "language_model.model.layers.39.self_attn.o_proj", "language_model.model.layers.39.self_attn.q_proj", "language_model.model.layers.39.self_attn.v_proj", "language_model.model.layers.4.linear_attn.in_proj_qkv", "language_model.model.layers.4.linear_attn.in_proj_z", "language_model.model.layers.4.linear_attn.out_proj", "language_model.model.layers.4.mlp.down_proj", "language_model.model.layers.4.mlp.gate_proj", "language_model.model.layers.4.mlp.up_proj", "language_model.model.layers.40.linear_attn.in_proj_qkv", "language_model.model.layers.40.linear_attn.in_proj_z", "language_model.model.layers.40.linear_attn.out_proj", "language_model.model.layers.40.mlp.down_proj", "language_model.model.layers.40.mlp.gate_proj", "language_model.model.layers.40.mlp.up_proj", "language_model.model.layers.41.linear_attn.in_proj_qkv", "language_model.model.layers.41.linear_attn.in_proj_z", "language_model.model.layers.41.linear_attn.out_proj", "language_model.model.layers.41.mlp.down_proj", "language_model.model.layers.41.mlp.gate_proj", "language_model.model.layers.41.mlp.up_proj", "language_model.model.layers.42.linear_attn.in_proj_qkv", "language_model.model.layers.42.linear_attn.in_proj_z", "language_model.model.layers.42.linear_attn.out_proj", "language_model.model.layers.42.mlp.down_proj", "language_model.model.layers.42.mlp.gate_proj", "language_model.model.layers.42.mlp.up_proj", "language_model.model.layers.43.mlp.down_proj", "language_model.model.layers.43.mlp.gate_proj", "language_model.model.layers.43.mlp.up_proj", "language_model.model.layers.43.self_attn.k_proj", "language_model.model.layers.43.self_attn.o_proj", "language_model.model.layers.43.self_attn.q_proj", "language_model.model.layers.43.self_attn.v_proj", "language_model.model.layers.44.linear_attn.in_proj_qkv", "language_model.model.layers.44.linear_attn.in_proj_z", "language_model.model.layers.44.linear_attn.out_proj", "language_model.model.layers.44.mlp.down_proj", "language_model.model.layers.44.mlp.gate_proj", "language_model.model.layers.44.mlp.up_proj", "language_model.model.layers.45.linear_attn.in_proj_qkv", "language_model.model.layers.45.linear_attn.in_proj_z", "language_model.model.layers.45.linear_attn.out_proj", "language_model.model.layers.45.mlp.down_proj", "language_model.model.layers.45.mlp.gate_proj", "language_model.model.layers.45.mlp.up_proj", "language_model.model.layers.46.linear_attn.in_proj_qkv", "language_model.model.layers.46.linear_attn.in_proj_z", "language_model.model.layers.46.linear_attn.out_proj", "language_model.model.layers.46.mlp.down_proj", "language_model.model.layers.46.mlp.gate_proj", "language_model.model.layers.46.mlp.up_proj", "language_model.model.layers.47.mlp.down_proj", "language_model.model.layers.47.mlp.gate_proj", "language_model.model.layers.47.mlp.up_proj", "language_model.model.layers.47.self_attn.k_proj", "language_model.model.layers.47.self_attn.o_proj", "language_model.model.layers.47.self_attn.q_proj", "language_model.model.layers.47.self_attn.v_proj", "language_model.model.layers.48.linear_attn.in_proj_qkv", "language_model.model.layers.48.linear_attn.in_proj_z", "language_model.model.layers.48.linear_attn.out_proj", "language_model.model.layers.48.mlp.down_proj", "language_model.model.layers.48.mlp.gate_proj", "language_model.model.layers.48.mlp.up_proj", "language_model.model.layers.49.linear_attn.in_proj_qkv", "language_model.model.layers.49.linear_attn.in_proj_z", "language_model.model.layers.49.linear_attn.out_proj", "language_model.model.layers.49.mlp.down_proj", "language_model.model.layers.49.mlp.gate_proj", "language_model.model.layers.49.mlp.up_proj", "language_model.model.layers.5.linear_attn.in_proj_qkv", "language_model.model.layers.5.linear_attn.in_proj_z", "language_model.model.layers.5.linear_attn.out_proj", "language_model.model.layers.5.mlp.down_proj", "language_model.model.layers.5.mlp.gate_proj", "language_model.model.layers.5.mlp.up_proj", "language_model.model.layers.50.linear_attn.in_proj_qkv", "language_model.model.layers.50.linear_attn.in_proj_z", "language_model.model.layers.50.linear_attn.out_proj", "language_model.model.layers.50.mlp.down_proj", "language_model.model.layers.50.mlp.gate_proj", "language_model.model.layers.50.mlp.up_proj", "language_model.model.layers.51.mlp.down_proj", "language_model.model.layers.51.mlp.gate_proj", "language_model.model.layers.51.mlp.up_proj", "language_model.model.layers.51.self_attn.k_proj", "language_model.model.layers.51.self_attn.o_proj", "language_model.model.layers.51.self_attn.q_proj", "language_model.model.layers.51.self_attn.v_proj", "language_model.model.layers.52.linear_attn.in_proj_qkv", "language_model.model.layers.52.linear_attn.in_proj_z", "language_model.model.layers.52.linear_attn.out_proj", "language_model.model.layers.52.mlp.down_proj", "language_model.model.layers.52.mlp.gate_proj", "language_model.model.layers.52.mlp.up_proj", "language_model.model.layers.53.linear_attn.in_proj_qkv", "language_model.model.layers.53.linear_attn.in_proj_z", "language_model.model.layers.53.linear_attn.out_proj", "language_model.model.layers.53.mlp.down_proj", "language_model.model.layers.53.mlp.gate_proj", "language_model.model.layers.53.mlp.up_proj", "language_model.model.layers.54.linear_attn.in_proj_qkv", "language_model.model.layers.54.linear_attn.in_proj_z", "language_model.model.layers.54.linear_attn.out_proj", "language_model.model.layers.54.mlp.down_proj", "language_model.model.layers.54.mlp.gate_proj", "language_model.model.layers.54.mlp.up_proj", "language_model.model.layers.55.mlp.down_proj", "language_model.model.layers.55.mlp.gate_proj", "language_model.model.layers.55.mlp.up_proj", "language_model.model.layers.55.self_attn.k_proj", "language_model.model.layers.55.self_attn.o_proj", "language_model.model.layers.55.self_attn.q_proj", "language_model.model.layers.55.self_attn.v_proj", "language_model.model.layers.56.linear_attn.in_proj_qkv", "language_model.model.layers.56.linear_attn.in_proj_z", "language_model.model.layers.56.linear_attn.out_proj", "language_model.model.layers.56.mlp.down_proj", "language_model.model.layers.56.mlp.gate_proj", "language_model.model.layers.56.mlp.up_proj", "language_model.model.layers.57.linear_attn.in_proj_qkv", "language_model.model.layers.57.linear_attn.in_proj_z", "language_model.model.layers.57.linear_attn.out_proj", "language_model.model.layers.57.mlp.down_proj", "language_model.model.layers.57.mlp.gate_proj", "language_model.model.layers.57.mlp.up_proj", "language_model.model.layers.58.linear_attn.in_proj_qkv", "language_model.model.layers.58.linear_attn.in_proj_z", "language_model.model.layers.58.linear_attn.out_proj", "language_model.model.layers.58.mlp.down_proj", "language_model.model.layers.58.mlp.gate_proj", "language_model.model.layers.58.mlp.up_proj", "language_model.model.layers.59.mlp.down_proj", "language_model.model.layers.59.mlp.gate_proj", "language_model.model.layers.59.mlp.up_proj", "language_model.model.layers.59.self_attn.k_proj", "language_model.model.layers.59.self_attn.o_proj", "language_model.model.layers.59.self_attn.q_proj", "language_model.model.layers.59.self_attn.v_proj", "language_model.model.layers.6.linear_attn.in_proj_qkv", "language_model.model.layers.6.linear_attn.in_proj_z", "language_model.model.layers.6.linear_attn.out_proj", "language_model.model.layers.6.mlp.down_proj", "language_model.model.layers.6.mlp.gate_proj", "language_model.model.layers.6.mlp.up_proj", "language_model.model.layers.60.linear_attn.in_proj_qkv", "language_model.model.layers.60.linear_attn.in_proj_z", "language_model.model.layers.60.linear_attn.out_proj", "language_model.model.layers.60.mlp.down_proj", "language_model.model.layers.60.mlp.gate_proj", "language_model.model.layers.60.mlp.up_proj", "language_model.model.layers.61.linear_attn.in_proj_qkv", "language_model.model.layers.61.linear_attn.in_proj_z", "language_model.model.layers.61.linear_attn.out_proj", "language_model.model.layers.61.mlp.down_proj", "language_model.model.layers.61.mlp.gate_proj", "language_model.model.layers.61.mlp.up_proj", "language_model.model.layers.62.linear_attn.in_proj_qkv", "language_model.model.layers.62.linear_attn.in_proj_z", "language_model.model.layers.62.linear_attn.out_proj", "language_model.model.layers.62.mlp.down_proj", "language_model.model.layers.62.mlp.gate_proj", "language_model.model.layers.62.mlp.up_proj", "language_model.model.layers.63.mlp.down_proj", "language_model.model.layers.63.mlp.gate_proj", "language_model.model.layers.63.mlp.up_proj", "language_model.model.layers.63.self_attn.k_proj", "language_model.model.layers.63.self_attn.o_proj", "language_model.model.layers.63.self_attn.q_proj", "language_model.model.layers.63.self_attn.v_proj", "language_model.model.layers.7.mlp.down_proj", "language_model.model.layers.7.mlp.gate_proj", "language_model.model.layers.7.mlp.up_proj", "language_model.model.layers.7.self_attn.k_proj", "language_model.model.layers.7.self_attn.o_proj", "language_model.model.layers.7.self_attn.q_proj", "language_model.model.layers.7.self_attn.v_proj", "language_model.model.layers.8.linear_attn.in_proj_qkv", "language_model.model.layers.8.linear_attn.in_proj_z", "language_model.model.layers.8.linear_attn.out_proj", "language_model.model.layers.8.mlp.down_proj", "language_model.model.layers.8.mlp.gate_proj", "language_model.model.layers.8.mlp.up_proj", "language_model.model.layers.9.linear_attn.in_proj_qkv", "language_model.model.layers.9.linear_attn.in_proj_z", "language_model.model.layers.9.linear_attn.out_proj", "language_model.model.layers.9.mlp.down_proj", "language_model.model.layers.9.mlp.gate_proj", "language_model.model.layers.9.mlp.up_proj" ], "inverse_modules": [ "language_model.model.embed_tokens" ], "gdn_v_grouped": true, "note": "Language-model matrices are stored in a blockwise Hadamard-rotated basis. A loader MUST apply x -> H(signs*x) before every forward module matmul and y -> signs*H(y) after the embedding lookup, or refuse to load. Plain affine loaders return wrong output silently." }, "source_model": { "name": "Ternary-Bonsai-2-27B-mlx-2bit", "repo": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "model_type": "prism_hadamard_qwen35", "base_model": "Qwen/Qwen3.8-27B", "config_sha256": "238de7c512cc56a733421e3fd011d88f8260739e3d00e32c5d65b7943cc9f837", "hadamard_sha256": "7132a3ec364f0bdac1f08f905f24f0ad2f14245060f592637a0396826d3b5fe6", "model_safetensors_sha256": "130de5925082c168b7866b2e91b52e44abbafc99017e3ca352b77b5b55a269ed", "dtype": "mlx-affine-2bit-ternary+float16-vision" }, "architecture": { "type": "qwen3_5", "text_model_type": "qwen3_5_text", "base_model": "Qwen3.8-27B", "has_vision": true, "has_ssm": true, "has_moe": false, "num_hidden_layers": 64, "attn_output_gate": true }, "layout": { "key_layout": "mlx-vlm-qwen3_5", "language_norms": "zero-centered-runtime-plus-one", "shifted_norm_count": 161, "linear_attn_conv1d": "mlx-layout-(channels,kernel,1)", "linear_attn_state_projections": "float32 in_proj_a/in_proj_b (Prism keeps them unquantized)", "gdn_activation_layout": "grouped", "vision_patch_embed": "mlx-channel-last" }, "runtime": { "target": "vmlx-python", "requires_hadamard_activation_transform": true, "requires_jang_affine1_expansion": false, "requires_jang_ternary_packed_expansion": true, "bundle_has_mtp": false, "mtp_layers": 0, "mtp_mode": "none", "mtp_num_speculative_tokens": 0, "mtp_status": "no MTP tensors in bundle (Prism pack ships none); native speculative decode unavailable", "total_weight_bytes": 6523610032, "total_weight_gib": 6.076 }, "size_report": { "bytes_by_class": { "text_packed": 5877760000, "text_signs": 11640832, "text_float32": 104953856, "vision_packed": 251582400, "vision_float16": 277409248 }, "total_weight_bytes": 6523346336, "total_weight_gib": 6.075 }, "capabilities": { "reasoning_parser": "qwen3", "tool_parser": "qwen3_coder", "think_in_template": true, "supports_tools": true, "supports_thinking": true, "family": "qwen3_5", "modality": "multimodal", "modalities": { "text": true, "vision": true, "video": true, "audio": false }, "has_vision": true, "has_audio": false, "has_video": true, "cache_type": "hybrid", "default_reasoning": "on" }, "chat": { "sampling_defaults": { "temperature": 1.0, "top_p": 0.95, "top_k": 20, "min_p": 0.0, "presence_penalty": 0.0, "repetition_penalty": 1.0, "source": "vendor_card+generation_config_2026-08-14", "mode": "thinking" }, "sampling_modes": { "thinking": { "temperature": 1.0, "top_p": 0.95, "top_k": 20, "min_p": 0.0, "presence_penalty": 0.0, "repetition_penalty": 1.0 }, "instruct_nothinking": { "temperature": 0.7, "top_p": 0.8, "top_k": 20, "min_p": 0.0, "presence_penalty": 1.5, "repetition_penalty": 1.0 } }, "stop_token_ids": [ 248046, 248044 ], "recommended_max_tokens": { "reasoning": 262144, "final_response": 131072 }, "context_length": { "native": 262144, "extensible": 1000000 } }, "reasoning": { "supported": true, "parser": "qwen3", "default": "on", "think_in_template": true, "enable_kwarg": "enable_thinking", "off_is_prefilled_closed_block": true, "off_prefill": "\n\n\n\n", "supported_reasoning_efforts": [ "low", "medium", "xhigh" ], "default_reasoning_effort": "xhigh", "reasoning_effort_transport": "chat_template_kwarg", "preserve_thinking_supported": true, "preserve_thinking_default": true, "preserve_thinking_transport": "chat_template_kwarg", "note": "Thinking is ON by default; disabling prefills a CLOSED think block. NEW in 3.8: reasoning_effort tiers xhigh (default) / medium / low — template raises on any other value. preserve_thinking is ON BY DEFAULT (verified empirically: no-kwarg render keeps history blocks) — the OPPOSITE of 3.6-style truncation; stable history improves prefix/KV cache reuse and agent decision consistency." }, "tools": { "supported": true, "parser": "qwen3_coder", "dialect": "xml_function", "mlx_lm_autodetected": true }, "vision": { "supported": true, "video_supported": true, "tower": "qwen3_5 ViT (27 layers, hidden 1152)", "processor": "preprocessor_config.json", "video_processor": "video_preprocessor_config.json" }, "drop_mtp": false, "mtp": { "num_layers": 0, "artifact_available": false, "tensor_count": 0, "runtime_available": false, "dedicated_embeddings": false, "upstream_method": "qwen3_next_mtp", "upstream_num_speculative_tokens": 2, "trained_multi_step": true, "recommended_num_drafts": 1, "notation": "Draft count is the unambiguous unit. vmlx native-MTP 'depth' and vLLM num_speculative_tokens both count DRAFTS; kit docs' D counts tokens/cycle (kit D2 == 1 draft == vmlx depth 1)." } }