{ "source_model": "Qwen/Qwen3.5-9B", "architecture": "32x native Qwen3.5 GatedDeltaNet", "converted_layers": [ 3, 7, 11, 15, 19, 23, 27, 31 ], "steps_per_converted_layer": 20, "seq_len": 128, "lr": 0.0001, "seed": 1234, "runtime_adapters": 0, "uni_max_runtime": 1, "phase_policy": "exact_bf16_prefill+autotuned_decode", "fusions": [ "residual+rmsnorm", "swiglu" ], "cuda_graph_decode_compatible": true }